【问题标题】:Is it possible to instantiate a DataFrame with a unicode column?是否可以使用 unicode 列实例化 DataFrame?
【发布时间】:2015-12-08 19:18:23
【问题描述】:

我正在尝试创建一个DataFrame,其中有一列存储unicode 数据而不是标准python string,因为我的语言有一些额外的重音字母,例如ñ, á, é 和其他人。

我尝试了以下方法。

x = sqlContext.createDataFrame([u"A", u"B", u"C"], ["letters"])

并显示下一个异常。

TypeError:无法推断类型的架构:<.type>

然后我阅读了type documentation 并没有找到兼容的数据类型,因此我问是否有人知道是否有可能实现这一目标?

【问题讨论】:

    标签: python apache-spark dataframe pyspark apache-spark-sql


    【解决方案1】:

    问题在于您如何提供不是unicode 数据的元素。即使您只有一列,每个元素也应该是受支持的类型,例如 Rowlisttuple

    df = sqlContext.createDataFrame([(u"A", ), (u"B", ), (u"C", )], ["letters"])
    

    【讨论】:

    • 这个问题看起来没什么用,但我敢打赌以后会有很多人遇到这个问题
    猜你喜欢
    • 2010-12-12
    • 1970-01-01
    • 2022-08-10
    • 1970-01-01
    • 2022-01-06
    • 1970-01-01
    • 2016-06-08
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多