【发布时间】:2020-03-30 14:28:22
【问题描述】:
我有一个看起来像这样的数据
subject_id hour_measure urine color heart_rate
3 1 red 40
3 1.15 red 60
4 2 yellow 50
我想重新索引数据,以便为每位患者进行 24 小时测量 我使用以下代码
mux = pd.MultiIndex.from_product([df['subject_id'].unique(), np.arange(1,24)],
names=['subject_id','hour_measure'])
df = df.groupby(['subject_id','hour_measure']).mean().reindex(mux).reset_index()
df.to_csv('totalafterreindex.csv')
它适用于数值,但对于分类值,它会删除它, 我如何增强此代码以将均值用于数字和最常见的分类
想要的输出
subject_id hour_measure urine color heart_rate
3 1 red 40
3 2 red 60
3 3 yellow 50
3 4 yellow 50
.. .. ..
【问题讨论】:
-
" 但使用分类值将其删除"。 “它”是什么?
-
我的意思是用这段代码,字符串值被删除(在我的数据集中,它删除了包含文本的列,比如尿液颜色)
标签: python python-3.x pandas scikit-learn