【发布时间】:2019-06-27 18:14:31
【问题描述】:
用例是读取文件并在其上创建数据框。之后获取该文件的架构并存储到数据库表中。
例如,我只是创建一个案例类并获取打印模式,但是我无法从中创建数据框
这是一个示例代码
case class Employee(Name:String, Age:Int, Designation:String, Salary:Int, ZipCode:Int)
val spark = SparkSession
.builder()
.appName("Spark SQL basic example")
.config("spark.master", "local")
.getOrCreate()
import spark.implicits._
val EmployeesData = Seq( Employee("Anto", 21, "Software Engineer", 2000, 56798))
val Employee_DataFrame = EmployeesData.toDF
val dfschema = Employee_DataFrame.schema
现在 dfschema 是一个结构类型,想把它转换成两列的数据框,如何实现
【问题讨论】:
-
dfschema 属于结构类型,具有案例类中定义的 5 列。你想转换成哪两列?
标签: scala apache-spark