【发布时间】:2020-11-08 20:27:22
【问题描述】:
所以我试图从制表符分隔的文本文件创建一个数据框,目的是使用数据框列标题中的一列中的值,并使用第二列作为值。当我尝试 df.pivot 时,我得到了我想要的,但是新列添加了额外的 NaN 值,而不是仅仅将新行正确排列。
制表符分隔的文本文件基本上是这样的:
round1 are you healthy no
round1 are you healthy yes
round2 are you healthy yes
round2 are you healthy yes
round3 are you healthy no
round3 are you healthy yes
所以我有这个:
import pandas as pd
import numpy as np
df = pd.read_csv('test.txt', sep='\t', usecols=[0,2], names=['colA','colB'])
df = df.pivot(index=None,columns='colA',values='colB')
print(df)
这给了我这个:
colA round1 round2 round3
0 no NaN NaN
1 yes NaN NaN
2 NaN yes NaN
3 NaN yes NaN
4 NaN NaN no
5 NaN NaN yes
但我想要实现的是:
colA round1 round2 round3
0 no yes no
1 yes yes yes
【问题讨论】:
标签: python pandas dataframe pivot-table