【发布时间】:2018-01-03 11:42:56
【问题描述】:
创建一个接受 TableName 和 Partition 列作为输入的通用代码。但是在尝试将数据帧写入分区表时遇到问题。
partAttr='product_category_id,product_id'
pattr=partAttr.split(",")
df.write.partitionBy('"'+'","'.join(pattr)+'"').saveAsTable(dataBase+".temptable_"+deltaTable)
pyspark.sql.utils.AnalysisException: u'partition column "product_category_id", "product_id" is not defined in table
bbiuserdb.temptable_products_stg, 定义的表列有:product_id, product_name, product_description, product_price, product_image, product_category_id;'
但是,如果我在 pattr 变量中有单个属性,则上述代码有效。
有没有人遇到过类似的情况?
【问题讨论】:
标签: hadoop pyspark spark-dataframe mapr