【发布时间】:2016-02-03 22:34:38
【问题描述】:
目前我正在运行我的程序
val conf = new SparkConf()
.setAppName("Test Data Analysis")
.setMaster("local[*]")
.set("spark.executor.memory", "32g")
.set("spark.driver.memory", "32g")
.set("spark.driver.maxResultSize", "4g")
即使我在一个由 5 台机器组成的集群上运行(每台机器都有 376 GB 物理 RAM)。我的程序出错了java.lang.OutOfMemoryError: Java heap space
我的数据量很大......但没有大到超过 32 GB 执行器内存 * 5 个节点。
我怀疑这可能是因为我使用“本地”作为我的主人。我看过文档说使用spark://machinename:7070
但是我想知道我的集群...如何确定这个 URL 和端口
编辑:我可以看到文档谈到了运行名为“spark-master.sh”的东西以使节点成为主节点。
在我的情况下,火花集群是由其他人设置/维护的,所以我不想通过启动自己的主节点来更改拓扑。
如何查询并找出哪个节点是现有的主节点。
我已经尝试在集群中随机选择一个节点,然后尝试 'spark://node:7077' 但这不起作用并给出错误
[15/11/03 20:06:21 WARN AppClient$ClientActor: Could not connect to
akka.tcp://sparkMaster@node:7077:
akka.remote.EndpointAssociationException: Association failed with
[akka.tcp://sparkMaster@node:7077]
【问题讨论】:
标签: apache-spark