【发布时间】:2022-01-10 12:25:47
【问题描述】:
我的数据框如下所示:
id std number
A 1 1
A 0 12
B 123.45 34
B 1 56
B 12 78
C 134 90
C 1234 100
C 12345 111
我想选择 Id 的随机行,同时保留其他行中的所有信息,这样数据框将如下所示:
id std number
A 1 1
A 0 12
C 134 90
C 1234 100
C 12345 111
我试过了
size = 1000
replace = True
fn = lambda obj: obj.loc[np.random.choice(obj.index, size, replace),:]
df2 = df1.groupby('Id', as_index=False).apply(fn)
和
df2 = df1.sample(n=1000).groupby('id')
但显然这不起作用。任何帮助将不胜感激。
【问题讨论】:
标签: python pandas random pandas-groupby rows