【发布时间】:2022-09-24 12:09:19
【问题描述】:
我有一些需要忽略的异常值的数据,但我正在努力找出如何做到这一点。我需要删除/忽略超过 500 的数据。到目前为止,以下是我的代码:
import pandas as pd
import matplotlib
#convert the files to make sure that only the data needed is selected
INPUT_FILE = \'data.csv\'
OUTPUT_FILE = \'machine_data.csv\'
PACKET_ID = \'machine\'
with open(INPUT_FILE, \'r\') as f:
data = f.readlines()
with open(OUTPUT_FILE, \'w\') as f:
for datum in data:
if datum.startswith(PACKET_ID):
f.write(datum)
#read the data file
df = pd.read_csv(OUTPUT_FILE, header=None, usecols=[2,10,11,12,13,14])
#plotting the conc
fig,conc = plt.subplots(1,1)
lns1 = conc.plot(df[2],df[11],color=\"g\", label=\'Concentration\')
如您所见,我选择了我需要的某些列,但在 [11] 中我只需要小于 500 的数据。
-
您能否为您的
df提供一个可重现的示例?理想情况下,您不应该像现在这样对df进行切片,而是应该使用loc, iloc, at, iat函数。 -
@guin0x 这是老师给我的,它在我的代码中运行良好,是我迄今为止唯一的代码。
-
我了解,但为了您以后的参考,请尽量避免。检查this post了解更多信息
标签: python pandas matplotlib