【发布时间】:2022-11-04 12:32:06
【问题描述】:
我有以下由 ID 和关联的簇号组成的数据框“数据”:
ID cluster
FP_101 1
FP_102 1
SP_209 3
SP_300 3
SP_209 1
FP_45 90
SP_50 90
FP_398 100
...
我想打印包含多个以 SP 和/或 FP 开头的 ID 的集群。 我认为我有答案的两个部分,但只是不知道以适当的方式将它们结合起来:
- data = data[data['ID'].str.startswith('FP')] (SP 相同)
- 选择函数:data = data.groupby(['cluster']).filter(lambda x: x['ID'].nunique() > 1)
结果应该来自上一个示例:
ID cluster
FP_101 1
FP_102 1
SP_209 1
SP_209 3
SP_300 3
我怎样才能结合安排这些功能来获得这个结果?
【问题讨论】: