【发布时间】:2020-07-02 14:28:54
【问题描述】:
我有一个数据框(我们称之为 df),它有一列(我们称之为 A)。
A 列的描述值包含文本(多个句子)。
我想将文本写入一个文本文件(text.txt),这样每一行只有一个句子。
所以,我想用句号(。)和问号(?)分割列 A 的内容,并将它们写入每一行的文本文件。 A 列的所有句子都在 1 个文件中,因此 text.txt 应该为每一行迭代地追加句子
这是我目前所拥有的,我已将列拆分为句子列表
import numpy as np
df['A'] = df['A'].apply(lambda x : str(x).split("."))
#np.savetxt('text.txt', A.values)
但我不确定,如何进一步进行, 有人可以帮忙吗?
【问题讨论】:
-
请提供示例 df 和堆栈跟踪。另外,
extr.values是什么? -
如果一个数据框中有多行,你如何分隔句子?或者您想将它们全部保存到一个文件中?
-
该列 A 中的所有句子都将在 1 个文件中,因此 text.txt 应该迭代地为每一行附加句子
-
@BalajiAmbresh,我删除了
extr.values,实际上是A.values