【发布时间】:2019-06-07 14:53:33
【问题描述】:
我正在尝试将 avro 文件加载到 sparks 数据帧中,以便将其转换为 pandas 并最终转换为字典。我要使用的方法:
df = spark.read.format("avro").load(avro_file_in_memory)
(注意:我试图加载到数据帧中的 avro 文件数据已经在内存中,作为来自 python 请求的请求响应的响应)
但是,此函数使用 databricks 环境的原生 sparks,我没有在该环境中工作(我查看了 pysparks 以获取类似的函数/代码,但我自己看不到任何东西)。
我可以在数据块之外使用任何类似的功能来产生相同的结果吗?
【问题讨论】:
标签: python apache-spark-sql avro databricks