【发布时间】:2018-06-22 10:30:26
【问题描述】:
如果我有一个数据框,例如
id quantity date
1 2.0 6-12-18
1 3.0 6-20-18
1 3.0 6-22-18
1 1.0 5-12-18
2 5.0 6-10-18
2 1.0 6-15-18
2 1.0 6-11-18
3 4.0 7-10-18
3 4.0 7-15-18
3 4.0 7-16-18
我想找到与特定 id 关联的“数量”列值的偏差。
我在想我可以聚合与特定 ID 关联的数量值并按日期排序数量值,并从为每个 ID 创建的整数列表中消除重复项。我的想法是使用 df.groupby 或者 pd.series.unique
目标是它看起来像这样:
id quantity date
1 1.0, 3.0, 3.0, 2.0 5-12-18, 6-12-18, 6-20-18, 6-22-18
2 5.0, 1.0, 1.0 6-10-18, 6-11-18, 6-15-18
3 4.0, 4.0, 4.0 7-10-18, 7-15-18, 7-16-18
然后我想在数据框中创建一个新列,它会说明数量值是增加、减少还是保持不变,所以它看起来像这样:
id quantity trend
1 1.0, 3.0, 3.0, 2.0 inc, same, dec
2 5.0, 1.0, 1.0 dec, same
3 4.0, 4.0, 4.0 same
谢谢:)
【问题讨论】:
-
我无法将输出与您的输入 df 匹配,您要检查吗?例如第一行
-
日期不正常,所以我希望实现的一件事是按日期订购数量值(这就是输出以 1.0 开头的原因,因为 id 的数量为 1.0 #1 on 5-12-2018 [它在输入 df 的第 4 行]) - 谢谢!
标签: python pandas dataframe group-by pandas-groupby