【发布时间】:2021-09-24 10:54:31
【问题描述】:
我有以下包含这些 CSV 文件的目录:
/data/one.csv
/data/two.csv
/data/three.csv
/data/four.csv
如果我想阅读所有内容,我可以这样做:
/data/*.csv
但我似乎无法阅读所有内容,除了four.csv。
这个:
/data/*[^four]*.csv
似乎可行,但我认为如果文件列表更大,那么这种读取方式可能是错误的(因为使用双通配符)。
有什么好办法吗?我也知道:
/data/{one,two,three,^four}.csv
会解决这个特定的情况,但我需要 except 方法以满足未来的需要。
非常感谢!
【问题讨论】:
标签: apache-spark hadoop pyspark hdfs