【发布时间】:2017-07-22 12:18:56
【问题描述】:
我最近开始尝试使用 Spark 和 Java。我最初使用RDD 浏览了著名的WordCountexample,一切都按预期进行。现在我正在尝试实现我自己的示例,但使用的是 DataFrames 而不是 RDD。
所以我正在从文件中读取数据集
DataFrame df = sqlContext.read()
.format("com.databricks.spark.csv")
.option("inferSchema", "true")
.option("delimiter", ";")
.option("header", "true")
.load(inputFilePath);
然后我尝试选择一个特定的列并像这样对每一行应用一个简单的转换
df = df.select("start")
.map(text -> text + "asd");
但是编译发现第二行有问题,我不完全理解(开始列推断为string类型)。
在接口 scala.Function1 中找到多个非覆盖抽象方法
为什么我的 lambda 函数被视为 Scala 函数,错误消息的实际含义是什么?
【问题讨论】:
标签: java apache-spark java-8 apache-spark-sql spark-dataframe