【发布时间】:2015-04-02 19:56:25
【问题描述】:
我需要将大约 200 万个 CSV 文件从 S3 存储桶加载到 Redshift 表中。这很容易(只需使用带有通配符或清单文件的COPY),除了我需要将每个文件的名称合并到结果表中。假设file1.csv 和file2.csv 都包含:
a,b,c
d,e,f
我希望我的桌子有
file1 a b c
file1 d e f
file2 a b c
file2 d e f
有没有一种方法可以通过单个COPY 语句来完成?还是我需要遍历文件列表并一次加载/插入一个?
我怀疑后一种选择会严重影响性能...
【问题讨论】:
标签: sql postgresql amazon-redshift