【发布时间】:2014-08-21 14:14:31
【问题描述】:
我有一个包含以下类别的 CSV 文件:item1,item2,item3,item4 其值恰好是以下之一:0,1,2,@ 987654328@,4。
我想为每个项目计算每个值有多少。
我的代码如下,df是对应的DataFrame:
outputDf = pandas.DataFrame()
cat_list = list(df.columns.values)
for col in cat_list:
s = df.groupby(col).size()
outputDf[col] = s
当我用read_csv 读取我的CSV 时,我想使用chunksize 参数做同样的事情,因为我的CSV 非常大。
我的问题是:我找不到找到cat_list 的方法,也找不到构建outputDf 的方法。
谁能给我一个提示?
【问题讨论】: