【发布时间】:2016-01-23 23:15:50
【问题描述】:
我将几本小说分块到一个名为documents 的数据框中。我想将每个块导出为单独的 .txt 文件。
由两列组成的数据框。第一列包含每个块的文件名,第二列包含将进入文件的实际文本。
documents[1,1]
[1] "Beloved.txt_1"
documents[1,2]
[1] "124 was spiteful full of a baby's venom the women......"
class(documents)
[1] "data.frame"
我正在尝试编写一个for 循环,该循环将获取每一行,将第二列设为 .txt 文件,并将第一列设为文件名。然后对每一行进行迭代。我一直在处理这样的事情:
for (i in 1:ncol(documents)) {
write(tagged_text, paste("data/taggedCorpus/",
documents[i], ".txt", sep=""))
我也一直在阅读,也许 cat 函数在这里可以很好地工作?
【问题讨论】:
-
请使用
dput(documents)的结果进行编辑。 -
@alistaire 这里要复制的东西太多了!您有兴趣确切了解什么?
-
不一定是您的数据,但要获得答案,您确实需要发布一份传真,以便人们了解您的数据的排列方式、类型、类别等。最好创建它带有一个真实 R 对象的
dput,因此其他人可以轻松加载它而无需重新输入所有内容。 -
@alistaire 谢谢!我添加了一些上下文