【问题标题】:Creating CombineFileSplit in Java of Hadoop?在 Hadoop 的 Java 中创建 CombineFileSplit?
【发布时间】:2017-08-19 00:25:12
【问题描述】:

CombineFileSplit 有一个构造函数:

CombineFileSplit(Path[] files, long[] start, long[] lengths, String[] locations) 

locations 数组是否必须与 files 数组大小相同,因为文件可以驻留在许多位置/节点中?

【问题讨论】:

    标签: hadoop filesplitting


    【解决方案1】:

    locations 数组的大小不必与 files 数组的大小相同,因为从 FileSplit 的构造函数中: public FileSplit(路径文件, 漫长的开始, 长长的, 字符串 [] 主机) 您可以得出结论,一个文件可以有许多位置/主机。此外,如果您看到 CombineFileSplit 的构造函数的源代码,您可以传递一个空字符串数组。我认为位置数组是供你使用的,所以如果你知道文件的位置,你可以提供它或传递空字符串。

    【讨论】:

      猜你喜欢
      • 2017-07-07
      • 2020-10-25
      • 1970-01-01
      • 2012-10-24
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 2015-01-31
      相关资源
      最近更新 更多