【发布时间】:2020-05-23 20:52:23
【问题描述】:
536381,22411,JUMBO SHOPPER VINTAGE RED PAISLEY,10,12/1/2010 9:41,1.95,15311,英国
"536381,82567,""AIRLINE LOUNGE,METAL SIGN"",2,12/1/2010 9:41,2.1,15311,United Kingdom"
536381,21672,WHITE SPOT RED CERAMIC DRAWER KNOB,6,12/1/2010 9:41,1.25,15311,United Kingdom
这些行是 csv 文件中的行示例。 我正在尝试在 Databricks 中阅读它,使用:
df = spark.read.csv ('file.csv', sep=',', inferSchema = 'true', quote = '"')
但是,由于字符串中的逗号,中间的行和其他类似的行没有进入右列。我该如何解决?
【问题讨论】:
标签: csv pyspark delimiter databricks