【发布时间】:2013-11-07 19:53:46
【问题描述】:
我有一个包含以下值的数据文件:
A 1
B 2
C 3
C 3
我写了以下猪脚本。
A = load 'users.txt' as (usr: int, nod: int);
B = GROUP A BY usr;
C = FOREACH B GENERATE group,COUNT(A);
现在,我想使用输出 C 并进一步处理它。如何引用 C 中的值/列?我尝试转储数据,但它们以键值对的形式出现?我是否需要将此输出写入文件,再次加载并处理?
谢谢, TM
【问题讨论】:
-
附注,根据您当前的架构,您将在 'column : usr' 中获得 NULL 值,因为您将其定义为 'int' 并且您有字符串值。
标签: hadoop apache-pig