【发布时间】:2023-02-02 13:26:23
【问题描述】:
我有一个具有以下结构的 DataFrame:
# Import pandas library
import pandas as pd
# initialize list of lists
data = [['R.04T', 1, 2013, 23456, 22, 1 ], ['R.04T', 15, 2014,
23456, 22, 1], ['F.04T', 9, 2010, 75920, 00, 3], ['F.04T', 4,
2012, 75920, 00, 3], ['R.04T', 7, 2013, 20054, 13, 1],
['R.04T',12, 2014, 20058,13, 1]]
# Create the pandas DataFrame
df = pd.DataFrame(data, columns=['product_code', 'sold', 'year', 'city_number',
'district_number', 'number_of_the_department'])
print(df)
我想知道这些地点 ('city_number' + 'district_number' + 'number_of_the_department') 是否增加或减少了每篇文章每年的销售额。我考虑过将列连接到一个位置列,如下所示:
# join the locations
df['location'] = df['city_number'].astype(str) + ','+
df['district_number'].astype(str) + ','+ df['number_of_the_department'].astype(str)
但我不确定如何分组? df 得到我的问题的答案。
我想知道销售额是否增加或减少(每年和项目)每年一定百分比(p.ex. 2013 到 2014 x% 减少)。
也许有人可以帮忙? :)
【问题讨论】:
-
我不太确定您希望输出如何......但是如果您这样做
df2 = df.groupby['product_code','year,'location']).max(),那么可以很容易地将所有文章一起可视化并查看哪一年的销量最好。 -
谢谢你。我想获得一个新的数据框,在其中我可以看到某个位置的一种产品在“已售出”类别中增加大约(比如说 40%)的年份。也许我可以尝试更好地形象化。
标签: python pandas dataframe numpy multiple-columns