【发布时间】:2023-04-02 15:58:01
【问题描述】:
我以前从未遇到过这个问题,但由于某种原因,当我在 spark scala 中将数据帧写入 CSV 时,输出 CSV 文件的格式完全错误。 1,没有任何标题行,2,列之间有随机的大空白。
但有趣的是,当我在 IDE 中执行 df.show 时,它输出的标题和格式都非常好。
我正在使用一个非常基本的通用写入 csv 方法,
df.write.csv("output.csv")
为什么会发生这种情况?是不是因为一些加入和合并,我正在做的事情是分布在集群中,并且在写入 CSV 之前无法正确重新格式化?
【问题讨论】:
标签: scala apache-spark