【发布时间】:2014-06-25 21:11:54
【问题描述】:
我正在尝试使用 pig 的 rank 运算符为给定字符串分配整数。虽然当我将 parallel 子句设置为 1 时它有效,但它没有更高的值(如 200)。我需要使用多个reducer来加快处理速度,因为默认情况下,pig只使用一个reducer,这需要很长时间。
我的查询如下:
rank = 按 col1 ASC 并行 200 对 tupl1 进行排名;
【问题讨论】:
-
请添加有关哪些不起作用的详细信息。如果有错误信息,你能显示出来吗?另外,您是否尝试使用少于 200 个减速器(例如 2 个)?
标签: hadoop hive apache-pig