【发布时间】:2015-01-05 11:37:01
【问题描述】:
您好,我正在尝试通过扩展 org.apache.pig.LoadFunc 为猪创建自定义加载器,它需要实现
public abstract org.apache.hadoop.mapreduce.InputFormat getInputFormat() throws java.io.IOException;
现在org.apache.hadoop.mapreduce.InputFormat 上面的格式是新 API,所以我必须通过扩展 org.apache.hadoop.mapreduce.InputFormat 创建自定义文件格式我已经使用新 API 创建了自定义文件格式,但我需要使用以下代码找出拆分主机的详细信息
String[] splitHosts = getSplitHosts(blkLocations, 0, length, clusterMap);
getSplitHosts() 在旧 API org.apache.hadoop.mapred.FileInputFormat 中可用,但在 org.apache.hadoop.mapreduce.lib.input.FileInputFormat 中不可用
我的问题是如何使用 org.apache.hadoop.mapreduce.lib.input.FileInputFormat 的新 API 找出 getSplitHosts()
请指导我是 Hadoop 新手,提前谢谢。
【问题讨论】:
标签: java hadoop mapreduce apache-pig