【发布时间】:2019-12-12 21:11:58
【问题描述】:
我有数据以 带有分区的镶木地板文件的形式存储在 S3 中。我正在尝试使用 presto 读取这些数据。如果我给出带有分区的镶木地板文件的完整位置,我就能够读取数据。以下是从“a 部分”读取数据的查询:
presto> create table IF NOT EXISTS default.sample(name varchar(255), age varchar(255), section varchar(255)) WITH (external_location = 's3://bucket/presto/section=a', format = 'PARQUET');
但我的数据被划分为不同的部分,即 s3://bucket/presto 文件夹包含多个文件夹,如“section=a”、“section=b”等。
我正在尝试使用以下分区读取数据:
presto> create table IF NOT EXISTS default.sample(name varchar(255), age varchar(255), section varchar(255)) WITH (partitioned_by = ARRAY['section'], external_location = 's3://bucket/presto', format = 'PARQUET');
正在创建表,但是当我尝试选择数据时,表为空。
我是 Presto 的新手,请帮忙。
谢谢
【问题讨论】:
标签: amazon-s3 partitioning parquet presto