【发布时间】:2015-10-23 15:24:20
【问题描述】:
我想了解如何设置一切以使 iPython 笔记本和 pyspark 正常工作。
我目前有一个 ec2 实例。
如果我错了,请告诉我,但我想我可以使用这个:
./spark-ec2 --key-pair=awskey --identity-file=awskey.pem --region=us-west-1 --zone=us-west-1a --spark-version=1.1.0 launch my-spark-cluster
或者这个:
aws emr create-cluster --name "Spark cluster" --release-label emr-4.1.0 --applications Name=Spark --ec2-attributes KeyName=myKey --instance-type m3.xlarge --instance-count 3 --use-default-roles
这两者真的有很大区别吗?
要编写和执行我的脚本,我应该在主节点上,对吧?
那么,我用来运行 Spark 的 ec2 实例将不会被使用?
(我必须在主节点上安装 ipython notebook 吗?)
提前感谢您的帮助。
(我一直在寻找教程,但没有找到我想要的内容。
你知道好的吗?)
【问题讨论】:
标签: python hadoop apache-spark ipython-notebook pyspark