【发布时间】:2018-06-14 19:16:54
【问题描述】:
假设我有一个这样的数据框
ID,Time1,Value1,Time2,Value2,Time3,Value3
1,2,1.1,3,1.2,4,1.3
1,5,2.1,6,2.2,7,2.3
预期的数据框是这样的
ID,Time,Value
1,2,1.1
1,3,1.2
1,4,1.3
1,5,2.1
1,6,2.2
1,7,2.3
如果行有唯一的 id,pd.wide_to_long 在这种情况下可以完美运行。
df = pd.wide_to_long(df, ['Time',Value],'ID','value', sep='', suffix='.+')\
.reset_index()\
.sort_values(['ID', 'Time'])\
.drop('value', axis=1)\
.dropna(how='any')
但是在这种情况下如何解决,如果行的 ID 不是唯一的
【问题讨论】: