【发布时间】:2018-08-23 03:56:10
【问题描述】:
我在使用 python 中的 pandas 更改现有 DataFrame 中的标题行时遇到问题。导入 pandas 和 csv 文件后,我将标题行设置为 None,以便能够在转置后删除重复的日期。然而,这给我留下了一个我不想要的行标题(实际上是一个索引列)。
df = pd.read_csv(spreadfile, header=None)
df2 = df.T.drop_duplicates([0], take_last=True)
del df2[1]
indcol = df2.ix[:,0]
df3 = df2.reindex(indcol)
上述缺乏想象力的代码在两个方面都失败了。索引列现在是必需的,但是所有条目现在都是 NaN。我对 python 的理解还不够好,无法识别 python 在做什么。下面的所需输出是我需要的,任何帮助将不胜感激!
重新索引前的df2:
0 2 3 4 5
0 NaN XS0089553282 XS0089773484 XS0092157600 XS0092541969
1 01-May-14 131.7 165.1 151.8 88.9
3 02-May-14 131 164.9 151.7 88.5
5 05-May-14 131.1 165 151.8 88.6
7 06-May-14 129.9 163.4 151.2 87.1
重新索引后的df2:
0 2 3 4 5
0
NaN NaN NaN NaN NaN NaN
01-May-14 NaN NaN NaN NaN NaN
02-May-14 NaN NaN NaN NaN NaN
05-May-14 NaN NaN NaN NaN NaN
06-May-14 NaN NaN NaN NaN NaN
需要df2:
XS0089553282 XS0089773484 XS0092157600 XS0092541969
01-May-14 131.7 165.1 151.8 88.9
02-May-14 131 164.9 151.7 88.5
05-May-14 131.1 165 151.8 88.6
06-May-14 129.9 163.4 151.2 87.1
【问题讨论】: