【发布时间】:2019-08-25 21:25:35
【问题描述】:
我想缩短和清理 CSV 文件以在 ElasticSearch 中使用它。 但是某些数据框(单元格)中有换行符,并且无法将 CSV 解析为 ElasticSearch。我现在用 pandas 缩短了 CSV 并尝试删除换行符,但它不起作用。
代码如下:
import pandas as pd
f=pd.read_csv("test.csv")
keep_col = ["Plugin ID","CVE","CVSS","Risk","Host","Protocol","Port","Name","Synopsis","Description","Solution",]
new_f = f[keep_col].replace('\\n',' ', regex=True)
new_f.to_csv("newFile.csv", index=False)
短缺正在发挥作用,但我在描述、概要和解决方案中有换行符。 知道如何用 Python / Pandas 解决它吗? CSV 有大约 100k 条目,因此必须在每个条目中进行换行符删除。
【问题讨论】:
-
尝试“df = df.replace('\n',' ', regex=True)”
-
我试过了,但是“df”到底是什么?它说...变量未定义。
-
嗨@MarvinKallohn,在您的情况下,
df将是f。您还可以使用 pandas 应用功能更好地检查,您可以在数据框列上运行该功能以删除换行符。 -
是的,我也这么想,并在我的代码中尝试过,正如您在上面看到的,但它仍然无法正常工作