【发布时间】:2013-10-29 00:17:43
【问题描述】:
我使用 CDH 4.7(包括 Impala 1.1)创建了一个简单的四节点 Hadoop 集群。我能够将 CSV 文件复制到 HDFS 并通过 the tutorial 中的描述创建和查询 Impala 表。但是我不能在不同的数据节点上查询同一张表:
[example.com:21000] > select * from tab1;
Query: select * from tab1
ERROR: AnalysisException: Table does not exist: default.tab1
我想也许我需要在第二个节点上重新发出CREATE TABLE 语句,但它突然知道表在那里:
[example.com:21000] > CREATE EXTERNAL TABLE tab1
> (
> id INT,
> col_1 BOOLEAN,
> col_2 DOUBLE,
> col_3 TIMESTAMP
> )
> ROW FORMAT DELIMITED FIELDS TERMINATED BY ','
> LOCATION '/user/dwheeler/sample_data/tab1';
Query: create EXTERNAL TABLE tab1
(
id INT,
col_1 BOOLEAN,
col_2 DOUBLE,
col_3 TIMESTAMP
)
ROW FORMAT DELIMITED FIELDS TERMINATED BY ','
LOCATION '/user/theory/sample_data/tab1'
ERROR: AlreadyExistsException: Table tab1 already exists
所以它知道它在那里,但我无法查询它 --- 或刷新它:
[example.com:21000] > refresh tab1;
Query: refresh tab1
ERROR: AnalysisException: Table does not exist: default.tab1
是否需要执行一些命令才能让所有 impalads 在数据节点上运行以创建可查询的表?
【问题讨论】: