【发布时间】:2019-11-01 08:30:03
【问题描述】:
我有一个 csv 文件:
Name;Date
A;2018-01-01 10:15:25.123456
B;2018-12-31 10:15:25.123456
我尝试用 Spark Dataframe 解析:
val df = spark.read.format(source="csv")
.option("header", true)
.option("delimiter", ";")
.option("inferSchema", true)
.option("timestampFormat", "yyyy-MM-dd HH:mm:ss.SSSSSS")
但生成的 Dataframe 在毫秒处(错误地)被截断:
scala> df.show(truncate=false)
+---+-----------------------+
|Nom|Date |
+---+-----------------------+
|A |2018-01-01 10:17:28.456|
|B |2018-12-31 10:17:28.456|
+---+-----------------------+
df.first()(1).asInstanceOf[Timestamp].getNanos()
res51: Int = 456000000
额外问题:以纳秒精度读取
【问题讨论】:
标签: scala csv apache-spark dataframe time