【发布时间】:2016-12-05 08:04:03
【问题描述】:
我创建了一个表 HCatalog 表,其中分区映射到 S3 中的一些 zip 文件。
在 Zeppelin 中,我使用 %pyspark 模块创建了一个段落,代码如下:
第 1 段:
%pyspark
from pyspark.sql import HiveContext
hc = HiveContext( sc )
f_req_2h = hc.table( "default.f_req_2h" ) # a HCatalog table in the default schema"
print f_req_sh.count()
f_req_2h.registerTempTable("f_req_2h")
当我运行它时,到目前为止一切都很好。然后我创建了第二段来查询第1段中注册的f_req_2h表,如下:
第 2 段:
%sql
select * from f_req_2h limit 1;
我收到了"table not found" 错误。任何帮助或指针表示赞赏。
【问题讨论】:
标签: pyspark apache-spark-sql apache-zeppelin