【发布时间】:2015-09-27 13:34:36
【问题描述】:
我正在配置 AWS pipline 以使用 JSON S3 文件中的数据加载 redshift 表。
我正在使用 RedshiftActivity,一切都很好,直到我尝试配置 KEEP_EXISTING 加载方法。我真的不想在每次加载时截断我的表,而是保留现有信息并添加新记录。
Redshift 活动似乎需要在表中定义 PRIMARY KEY 才能工作(OK)...现在它还要求我配置 DISTRIBUTION KEY,但我对 EVEN 分发感兴趣,似乎 DISTRIBUTION KEY 不能与均匀分布风格。
我可以使用分配键模拟 EVEN 分配吗?
谢谢。
【问题讨论】:
标签: amazon-web-services amazon-redshift amazon-data-pipeline