【发布时间】:2016-09-24 02:27:37
【问题描述】:
我是 spark 和 sparkR 的新手,我的问题如下: 当我写下面的代码时: 1)。设置环境并启动 spark.session()
sparkR.session(master = "my/spark/master/on/one/server/standaloneMode", , sparkConfig = list(spark.driver.memory="4g",spark.sql.warehouse.dir = "my/hadoop_home/bin",sparkPackages = "com.databricks:spark-avro_2.11:3.0.1"))
然后我写道:
rund <- data.frame(V1 = runif(10000000,100,10000),V2 =runif(10000000,100,10000))
df <- as.DataFrame(rund)
事情是这样的:
1)。程序在哪里进行“拆分”?在我的本地机器上还是在服务器上?
2)。另外,谁能告诉我程序到底在哪里运行代码“as.DataFrame()”?在我的计算机或我的服务器上设置为独立模式的火花。
【问题讨论】:
标签: r apache-spark sparkr