【发布时间】:2017-06-08 11:20:26
【问题描述】:
我是新的 apache-spark。我已经在 spark 独立模式下测试了一些应用程序。但我想运行应用程序 yarn 模式。我在 windows 中运行 apache-spark 2.1.0。这是我的代码
c:\spark>spark-submit2 --master yarn --deploy-mode client --executor-cores 4 --jars C:\DependencyJars\spark-streaming-eventhubs_2.11-2.0.3.jar,C:\DependencyJars\scalaj-http_2.11-2.3.0.jar,C:\DependencyJars\config-1.3.1.jar,C:\DependencyJars\commons-lang3-3.3.2.jar --conf spark.driver.userClasspathFirst=true --conf spark.executor.extraClassPath=C:\DependencyJars\commons-lang3-3.3.2.jar --conf spark.executor.userClasspathFirst=true --class "GeoLogConsumerRT" C:\sbtazure\target\scala-2.11\azuregeologproject_2.11-1.0.jar
例外:使用 master 'yarn' 运行时,必须在环境中设置 HADOOP_CONF_DIR 或 YARN_CONF_DIR。在火花中
所以从搜索网站。我创建了一个文件夹名称 Hadoop_CONF_DIR 并将 hive site.xml 放入其中并指向环境变量,之后我运行 spark-submit 然后我得到了
连接被拒绝异常 我想我无法正确配置纱线模式。有人可以帮我解决这个问题吗?我需要分别安装 Hadoop 和 yarn 吗?我想以伪分布式模式运行我的应用程序。请帮我在 windows 中配置 yarn 模式,谢谢
【问题讨论】:
标签: hadoop apache-spark pyspark hadoop-yarn