【发布时间】:2017-09-27 18:13:19
【问题描述】:
sc = pyspark.SparkContext()
sqlCxt = SQLContext(sc)
df=sqlCxt.read.format("csv").option("delimiter","|").load("D:/SparkPy/u.item")
错误:
ERROR:root: 对输入进行标记时发生意外错误 以下回溯可能已损坏或无效 错误信息是:('EOF in multi-line string', (651, 72))
【问题讨论】:
-
此错误与 pyspark 无关。您的文件缺少引号、撇号或其他内容。检查错误消息中给出的行号。
-
这看起来不像 csv 问题,即使在创建了一个虚拟 csv 并使用它之后,我也会遇到同样的错误。
-
你能分享产生上述错误的最小可能虚拟csv文件的内容吗?
标签: python csv pyspark jupyter