【发布时间】:2021-02-23 14:11:06
【问题描述】:
我有一个形状 (10x401) 的数据框,其中包含具有相同列名和值的重复列。其中一些具有空值,而另一些具有数值。列名称未按排序顺序。下面给出了一个简短的数据框示例:
ID#, 1, 1, 1, 1, 2, 2, 2, 2, 3, 3, 3, 3,.........,100, 100, 100, 100
1, , , , , 3, 3, 3, 3, , , , ,........., 0, 0, 0, 0
2, 0, 0, 0, 0, , , , , 10, 10, 10, 10,........., , , ,
3, 9, 9, 9, 9, 1, 1, 1, 1, 4, 4, 4, 4,........., 1, 1, 1, 1
.
.
.
10, , , , , , , , , , , , ,........., 6, 6, 6, 6
通过忽略空值,对于忽略 ID 列的所有 10 行和 400 列,我需要将每个第一次出现的数值(从 0 到 10)替换为 1,并将其余值替换为 -1。生成的数据框将如下所示:
ID#, 1, 1, 1, 1, 2, 2, 2, 2, 3, 3, 3, 3,.........,100, 100, 100, 100
1, , , , , 1, -1, -1, -1, , , , ,........., 1, -1, -1, -1
2, 1, -1, -1, -1, , , , , 1, -1, -1, -1,........., , , ,
3, 1, -1, -1, -1, 1, -1, -1, -1, 1, -1, -1, -1,........., 1, -1, -1, -1
.
.
.
10, , , , , , , , , , , , ,........., 1, -1, -1, -1
我会感谢您在此提供的帮助。
【问题讨论】:
标签: python pandas list dataframe csv