【问题标题】:Connecting to Teradata using Spark JDBC使用 Spark JDBC 连接到 Teradata
【发布时间】:2017-11-20 06:32:37
【问题描述】:

我正在尝试使用 Spark JDBC 连接以从 Teradata 提取数据。我在主父目录上创建了一个“lib”目录,并放置了外部 Teradata jar 并运行了 sbt 包。此外,我还在我的 spark-shell 命令中提供了“--jars”选项来提供 jar。但是,当我运行 spark-shell 时,它似乎找不到类

Exception in thread "main" java.lang.ClassNotFoundException: com.teradata.hadoop.tool.TeradataImportTool

但是,当我对 jar 文件执行“jar tvf”时,我看到了该类。不知何故,Spark 实用程序无法找到该 jar。我还需要做什么才能让 Spark 找到它吗?请帮忙

【问题讨论】:

  • 尝试将其添加到您的胖罐中。这在类似的情况下帮助了我。

标签: apache-spark teradata


【解决方案1】:

这个特定的类com.teradata.hadoop.tool.TeradataImportToolteradata-hadoop-connector.jar

您可以在提交作业时尝试通过,如下例:

--conf spark.driver.extraClassPath complete path of teradata-hadoop-connector.jar
--conf spark.executor.extraClassPath complete path of teradata-hadoop-connector.jar

将 jars 导入驱动程序和执行程序。因此,您需要编辑conf/spark-defaults.conf 在下面添加两行。

spark.driver.extraClassPath complete path of teradata-hadoop-connector.jar
spark.executor.extraClassPath complete path of teradata-hadoop-connector.jar

【讨论】:

  • 有效吗?如果是,您可以投票/接受所有者身份或说这是我的问题...沉默无济于事!
猜你喜欢
  • 2018-01-09
  • 1970-01-01
  • 2020-07-14
  • 2014-01-26
  • 2019-06-02
  • 2014-04-08
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
相关资源
最近更新 更多