【发布时间】:2019-10-31 17:50:54
【问题描述】:
我是大数据和蜂巢的新手。 需要与其他开发人员合作开发 Spark 流应用程序,其中涉及从 Kafka 读取数据并将其放置在 hive/hdfs 上。其他开发人员使用/指向 hdfs 的相同位置,读取 hive 文件并进行进一步处理。
我的开发环境是 Windows 系统上的 Eclipse。 其他开发者环境是他机器上的 Eclipse。
由于两者都在处理相同的文件,我们之间是否可以共享 hdfs 路径?
请分享 Spark 开发团队如何处理此类场景的详细信息?
建议最佳实践等
非常感谢, 夏姆
【问题讨论】:
标签: apache-spark hadoop hive apache-kafka spark-streaming