【发布时间】:2020-08-03 08:45:14
【问题描述】:
我有一个像这样的文本文件
******************** extractive sentences ********************
[gold] This is gold sentence
[raw ] This is raw sentence
[rev ] This is rev sentence
[ref ] This is ref sentence
******************** extractive sentences ********************
[gold] This is gold sentence
[raw ] This is raw sentence
[rev ] This is rev sentence
[ref ] This is ref sentence
我想创建一个 CSV,这样所有的 [gold] 句子都会出现
在第一列中,对应的[rev]句子在第二列中
我尝试使用pd.read_csv 读取文件,但由于句子中可能包含“,”而出现错误,并且出现如下错误:
'Expected 1 fields in line 11, saw 2'
谁能帮我解决这个问题?
【问题讨论】:
-
为什么不用原始 python 打开:打开
-
是的,我可以这样做,但是在那之后呢?
-
你可以将它们排列成标准的csv或tsv文件,然后用pandas打开
-
作为普通文件读取,拆分为行列表 - 您甚至可以将此列表转换为
dataframe一列 - 然后您可以将带有gold的行过滤到新 @987654328 中的新列@,与raw、rev、ref相同 -
始终将代码、数据和错误消息作为文本而不是图像。对于图像上的数据,我们无法使用它来创建示例代码 - 这样您就不会得到答案。