【发布时间】:2019-04-04 04:59:51
【问题描述】:
我已经生成了一个表格数据集,我正在尝试使用 python 以 xls 格式查询并生成报告。我已将数据放入 pandas 数据框中,并将所有可能相关的字段按正确的顺序排列,现在我需要选择每行中的特定列满足特定条件的位置。如果满足该条件,我想包含同一行中的特定字段。我对如何进一步查询这个数据集有点迷茫。
columns = ['type_1','price_1','color_1','type_2','price_2','color_2','type_3','price_3','color_3' ]
1'Car','300','Grey','None','None','None,'Truck','500','blue'
2'Van','250','White','Car','300','Green','Car','350','Black'
3'None','None','None','None','None','None','None','None','None'
4'None','None','None''Car','600','Yellow''None','None','None'
5'Van','250','White','Car','300','Green','Van','250','White'
我想查询此数据集以输出汽车,如果是汽车,则包括价格和颜色。那么如何遍历上面的行并使用 pandas 生成下面的输出呢?
'Car','300','Grey'
'Car','300','Green''Car','350','Black'
'Car','600','Yellow'
'Car','300','Green'
我觉得这里有两种方法,查询数据集,在不满足所需条件的地方剥离,即:
df[df.type_1 != 'Car' OR df.type_2 != 'Car' OR df.type_3 != 'Car']
或创建一个新的数据帧并在满足条件时写入/附加到它。
我对 pandas 和它的功能是全新的,因此不胜感激!
【问题讨论】:
-
如果没有,你想检索哪一列?您有几列
-
如果你问我,他的预期输出很清楚。
-
@Rarblack 3 列,其中 type= 'Car'。例如,如果 type_1 = 'Car' 给我 'Type_1', 'Price_1', 'Color_1'。