【发布时间】:2017-12-28 07:29:20
【问题描述】:
我有一个 RDD,其中包含我的自定义类 OmnitureData 的对象类型。 OmnitureData 数据包含 1000 个数据变量。我想将数据写入 S3。
data: RDD[OmnitureData]
data.saveAsTextFile(path)
在 S3 中,我将数据视为:
OmnitureFeedOutputEntry@5655c68b
OmnitureFeedOutputEntry@kgfwe77c
OmnitureFeedOutputEntry@4rjkks8f
OmnitureFeedOutputEntry@57bfgk6d
OmnitureFeedOutputEntry@646lk6sd
如何以可以看到 OmnitureData 成员实际数据的方式存储它?
【问题讨论】:
标签: scala apache-spark amazon-s3 rdd