【问题标题】:CSV Data preprocessing and reformatting pythonCSV数据预处理和重新格式化python
【发布时间】:2019-04-18 10:06:25
【问题描述】:

我有一个包含 22000 行的 csv 文件。我需要使用 python 将 csv 文件从普通的行和列格式转换为元素用逗号分隔的行。具有相同 id 的元素将在一行中。将为每个 id 创建新行。

Sample data before preprocessing is like this

Dataset after processing is like this

我只想删除日期列并内联显示具有相同 id 的元素(在 B 列中)。

【问题讨论】:

  • 到目前为止您尝试过什么?所有的苹果等都去哪儿了?你到底想做什么?你想计算每个项目的出现次数吗?时间戳从何而来?请发布一个完全涵盖您的问题的示例。
  • 我的解决方案对你有用吗?
  • 对不起,伙计们。我在屏幕截图的位置上犯了一个错误。请查看已编辑的问题。
  • @DheerajRavishankar - 不要将样本数据作为图像。将您的示例数据粘贴为文本(以便于复制和粘贴给其他人)。

标签: python pandas csv numpy


【解决方案1】:

我认为你需要这个,

print pd.Series(sum(df.T.values.tolist(),[])).value_counts().reset_index()

【讨论】:

    猜你喜欢
    • 1970-01-01
    • 2012-06-07
    • 1970-01-01
    • 2015-12-07
    • 1970-01-01
    • 2015-11-09
    • 2016-10-04
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多