【发布时间】:2019-04-05 13:40:03
【问题描述】:
我正在尝试过滤文件,以便保留“单元格名称”为 LM-MP-NW-URBAN-GROCERY S & SPAZA 的数据行,但是当我运行上述代码时,我得到了
"SyntaxError: 无效语法"
我使用带有数字的列尝试了该代码,它与 == 和 <, > 符号一起使用。
另外,请帮助我了解如何过滤多个项目 - 例如在上面的代码中,我想保留所有单元格名称为 LM-MP-NW-URBAN-GROCERY S & SPAZA 或 KZN-GP-EC-URBAN_GROCERY S & SPAZA 的数据
提前谢谢你
#Import libraries
import pandas as pd
import os
import glob
#Set working directory and create list of raw files
os.chdir(r'C:\Users\Shab7002\Documents\data science\18 10 9\nestle 708294\infant')
lorf = glob.glob('*.txt')
#Create empty dataframe and concatenate raw files
df_mrgd = pd.DataFrame()
for file in lorf:
df_add = pd.read_csv(file,sep='\t', encoding='latin-1')
df_mrgd = pd.concat([df_mrgd, df_add.head(10)])
#Filter columns
filt_col = ['PeriodVFP', 'Product name', 'MBD Name', 'Outlet name', 'Cell Name', 'Sales', 'SalesValue', 'SalesVolume']
#filter rows
df_filtered = df_mrgd[filt_col].query('Cell Name== "LM-MP-NW-URBAN-GROCERY S & SPAZA"')
#and export concatenated data frame
df_filtered.to_excel('mu.xlsx')
【问题讨论】:
-
请为您的错误提供完整的追溯,而不仅仅是错误描述。