【发布时间】:2017-03-22 23:43:39
【问题描述】:
我在 hadoop 中有两个 Csv,比如 csv1、csv2。两个 csv 都包含两列(时间戳和某个值),例如 csv1 的列是 t1、v1,而 csv2 的列是 t2、v2。 我想为每个 t1 = t2(对于相同的时间戳)计算 v1*v2,并使用 spark java Api 将结果作为文本文件存储在 hdfs 中。
我是新来的火花,请有人帮助我。
提前感谢。
【问题讨论】:
标签: java hadoop spark-java bigdata