【发布时间】:2021-12-04 13:39:35
【问题描述】:
说明。如何在 PySpark 中将字典数据集转换为 DataFrame:
错误/非预期结果我试过了
df = spark.createDataFrame([Row(**i) for i in bounds])
但得到:
TypeError:无法推断类型的架构:
这段代码:
rdd = sc.parallelize(bounds)
rdd.map(lambda x: (x,)).toDF().show()
和其他人给出了意想不到的结果。
预期结果:
我的数据集:
【问题讨论】:
-
我已经查看了 StackOverflow 中的所有解决方案,但它们没有帮助。我是 Pyspark 的新手。