【发布时间】:2021-05-13 16:37:08
【问题描述】:
我有以下代码;
test_df = (spark.read
.schema(newSchema)
.option("header", "true")
.option("delimiter", "\t").csv("wasbs://container@AzureStorageAcc.blob.core.windows.net/dir1/dir2/2021/02/05/"))
但这似乎不起作用。有没有其他方法可以将 tsv.gz 读取为 spark 数据帧?
【问题讨论】:
标签: apache-spark pyspark azure-blob-storage databricks