【发布时间】:2016-08-19 19:59:41
【问题描述】:
我有一个像这样的现有 S3 文件夹结构,
s3://mydata/{country}/{date}/
{country}可以是 30 个不同国家/地区中的任何一个{date}可以是自 20150101 以来的任何日期
如何通过将 {country} 视为分区并将 {date} 视为子分区来在 Hive 中读取此内容?
【问题讨论】:
-
你找到答案了吗?我也很好奇。
-
Hive 需要 '=' 来自动理解分区。实现这一点的唯一方法是分别创建指向父路径的表并使用特定路径“添加分区”。