【发布时间】:2018-05-14 09:44:14
【问题描述】:
我是 Spark 的新手,想在 Spark 流上运行 Spark SQL 查询。
我目前的理解是,我需要在我的 Spark 作业的代码中定义我的 SQL 查询,因为从 Spark SQ 主页中提取的这个 sn-p 显示:-
spark.read.json("s3n://...")
.registerTempTable("json")
results = spark.sql(
"""SELECT *
FROM people
JOIN json ...""")
我想做的是在某个地方自行定义我的查询 - 例如。 .sql 文件 - 然后将其部署在 Spark 集群上。
谁能告诉我 Spark 目前是否支持这种架构?例如。一些 API?
【问题讨论】:
-
你用的是python对吗?
标签: apache-spark apache-spark-sql spark-streaming