【发布时间】:2015-11-01 03:38:44
【问题描述】:
我有一个结果 RDD labelsAndPredictions = testData.map(lambda lp: lp.label).zip(predictions)。这具有以下格式的输出:
[(0.0, 0.08482142857142858), (0.0, 0.11442786069651742),.....]
我想要创建一个 CSV 文件,其中一列用于labels(上述输出中元组的第一部分),另一列用于predictions(元组输出的第二部分)。但我不知道如何使用 Python 在 Spark 中写入 CSV 文件。
如何使用上述输出创建 CSV 文件?
【问题讨论】:
标签: python csv apache-spark pyspark file-writing