【发布时间】:2020-07-17 19:51:21
【问题描述】:
我有一个包含 12 列(药物类别)的数据框,其中相同的值(药物类别名称)可能会出现在不同的列中。
DRG01 DRG02 ... DRG11 DRG12
0 AMOXYCILLIN ORAL SOLIDS AMOEBICIDES ORAL SOLIDS ... NaN NaN
1 VITAMIN DROPS NaN ... NaN NaN
2 AMOXYCILLIN ORAL SOLIDS ANTIHISTAMINES ORAL LIQ ... NaN NaN
3 AMOEBICIDES ORAL LIQUID NaN ... NaN NaN
... ... ... ... ... ...
81531 NaN NaN ... NaN NaN
[81532 rows x 12 columns]
我的目标是创建一个矩阵(二维数组) - 行和列由唯一的药物类别名称组成(忽略/删除 NaN 值)。单元格的值将是这些药物类别名称连续出现的次数。本质上,我正在尝试实现以下目标:
AMOXYCILLIN ORAL SOLIDS AMOEBICIDES ORAL SOLIDS ANTIHISTAMINES ORALLIQ VITAM..
AMOXYCILLIN ORAL SOLIDS 0 1 1 0
AMOEBICIDES ORAL SOLIDS 1 1 0 0
ANTIHISTAMINES ORAL LIQ 1 0 0 0
VITAMIN DROPS 0 0 0 1
.....
.....
【问题讨论】:
-
有趣的问题!也许您可以重新制定一下并考虑How to create a Minimal, Reproducible Example
标签: python pandas dataframe matrix multidimensional-array