【发布时间】:2019-08-15 05:48:28
【问题描述】:
我正在尝试将 pandas 数据框的分类列重新编码为更合理的分类列。
为简单起见,我采用具有“客舱”列的泰坦尼克号数据。我正在尝试合并所有 A10 A20 A22 并将其重新编码为 A,类似地 C10、C12 到 C 等等。
我已经尝试过使用子集,这是我的代码。
for i in ['A','B','C']:
for x in train[train.Cabin.str.contains(i)].loc[:,'Cabin'].index:
train.loc[x,'Cabin'] = i
我正在寻找的是一种有效的方法。我是新手,我认为这不是正确的方法。请指导我。如果我违反了任何堆栈溢出规则,我很抱歉。
【问题讨论】:
标签: python pandas dataframe subset