【发布时间】:2016-09-01 13:15:10
【问题描述】:
我正在尝试在 spark 作业中读取 na lzo 文件。
我的 spark 版本是 1.6.0 (spark-core_2.10-1.6.0-cdh5.7.1)。
这是我的java代码:
JavaSparkContext sc = new JavaSparkContext(new SparkConf().setAppName("ReadLzo"));
JavaPairRDD <NullWritable, Text> lines = sc.newAPIHadoopFile(args[0],LzoTextInputFormat.class,NullWritable.class,Text.class,new Configuration());
但是我得到一个编译时异常:
方法newAPIHadoopFile(String, Class, Class, Class, JavaSparkContext 类型中的配置)不适用于 参数(字符串、类、类、 类,配置)
那么在Java中使用JavaSparkContext.newAPIHadoopFile()的正确方法是什么?
【问题讨论】:
-
泛型 F、K 和 V 有哪些类型?
标签: java hadoop apache-spark