【发布时间】:2015-03-19 01:36:17
【问题描述】:
作为一个 hadoop/Spark 初学者,我已经按照website 中的教程进行操作,并在我的单机(CentOS 6)上成功部署了一个 hadoop 框架。现在我想在同一台机器上安装 Spark 1.2,并让它与我机器上的单节点 Yarn 集群一起工作,这意味着在我的单机上存储在 hdfs 上的文件上执行 Spark SQL 并将结果输出到 hdfs。对于所需的其余步骤,我没有在线找到适合此场景的好的教程。
到目前为止我所做的是:
(1) 从 Scala 官方网站下载 scala 2.9.3 并安装。 “scala -version”命令有效!
(2) 从 Apache Spark 网站下载 Spark 1.2.1(为 Hadoop 2.4 或更高版本预构建)并已解压缩。
接下来要做什么?如何更改 Spark 目录中的哪个配置文件?有人可以提供一步一步的教程吗?特别是如何配置 spark-env.sh。越详细越好。谢谢! (如果您对我如何配置 hadoop 和 yarn 有疑问,我完全按照我之前提到的那个网站中列出的步骤进行操作)
【问题讨论】:
标签: hadoop centos apache-spark