【发布时间】:2018-09-22 12:43:23
【问题描述】:
我在生产线上有一个测量值,例如:
import pandas as pd
import random
random.seed(2)
df = pd.DataFrame()
df['col1_date'] = pd.date_range('2018-09-01', periods=40, freq='D')
df['col2_id'] = pd.DataFrame(list(['A', 'B', 'C', 'D'] *10))
df['MeasuredValues'] = np.random.choice(10, 40)
df
基本上这些项目,例如 ['A', 'B', 'C', 'D'] 会随着它在行中取得进展而针对某些参数进行测量。我正在尝试在表格中添加一列,为我 col2_id 中的每个项目提供一系列测量,例如:第一次测量时我得到1st measurement,然后第二次测量我获取2nd measurement 等等。我可以通过对col2_id 和col1_date 进行排序,在 excel 中手动完成一个 100 行的小表格。显然,对于成千上万的大量行,它没有多大意义。然后我可以比较col2_id 中所有项目的不同测量值。我不知道如何在 Pandas 或 Python 中做到这一点。
谁能给我一些建议?
【问题讨论】: