【问题标题】:Extract values from selected columns and rows in PySpark从 PySpark 中的选定列和行中提取值
【发布时间】:2020-08-18 20:26:52
【问题描述】:

火花 3.0

我想将选定列中的特定值提取到从 spark DF 到我的 juypter 子窗口的打印函数中。 我将做一个 for 循环,这样我就可以自动化每月的文件。

举个例子,print('A 公司一名男性作为 IT 的平均工资是 26000')。

例如,我尝试了 x['company'][0][0],但没有得到所需的值。

【问题讨论】:

    标签: python pyspark


    【解决方案1】:

    这可能就是你要找的。​​p>

    df.select('company').collect()[0][0]
    

    【讨论】:

      猜你喜欢
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 2019-10-16
      相关资源
      最近更新 更多