【发布时间】:2015-10-11 13:52:56
【问题描述】:
我有一个 PySpark 代码,它可以像这样写入 SQL Server 数据库
df.write.jdbc(url=url, table="AdventureWorks2012.dbo.people", properties=properties)
但是问题是,即使表存在,我也想继续在表中写入人员,并且我在 Spark 文档中看到可能存在选项错误、追加、覆盖和忽略模式,并且所有这些都会引发错误,如果表已存在于数据库中,则对象已存在。
Spark throw 跟随错误 py4j.protocol.Py4JJavaError: 调用 o43.jdbc 时出错。 com.microsoft.sqlserver.jdbc.SQLServerException:数据库中已经有一个名为“people”的对象
即使表已经退出,有没有办法将数据写入表中? 请让我知道您需要更多解释
【问题讨论】:
标签: apache-spark pyspark