【发布时间】:2021-09-25 10:42:18
【问题描述】:
我想为每一行设置 ART_IN_TICKET 的值是与该行具有相同 TICKET_ID 的行数。
例如,对于此数据帧的前 5 行,TICKET_ID 为 35592159,ART_IN_TICKET 应为 5,因为有 5 行具有相同的 TICKET_ID。
【问题讨论】:
我想为每一行设置 ART_IN_TICKET 的值是与该行具有相同 TICKET_ID 的行数。
例如,对于此数据帧的前 5 行,TICKET_ID 为 35592159,ART_IN_TICKET 应为 5,因为有 5 行具有相同的 TICKET_ID。
【问题讨论】:
也可以有其他解决方案。一个相对简单的解决方案是获取每个TICKET_ID 的行数,然后将新的df 与这个合并以获得ART_IN_TICKET 中的最终结果。假设上述数据框位于df。
count_df = df[['TICKET_ID', 'ART_IN_TICKET']].groupby("TICKET_ID").count().reset_index()
df = df[list(set(df.columns.tolist())-set(["ART_IN_TICKET"]))] # Removing ART_IN_TICKET column before merging
final_df = df.merge(count_df, on="TICKET_ID")
【讨论】: