【问题标题】:How do I access elements of a corpus and write to file in R?如何访问语料库的元素并在 R 中写入文件?
【发布时间】:2017-10-13 20:58:55
【问题描述】:

我正在处理 R 中的一个 vcorpus,如下所示:

我为每个单独的文档调用 content-> content,然后调用 content->meta-> id。我想只写 content-> content 和 content->meta-> id 来分隔每个文档的文本文件。

【问题讨论】:

    标签: r nlp rstudio corpus


    【解决方案1】:

    创建一个函数来提取你想要的元素,然后将它应用到你的语料库中。

    类似这样的:

    extractContentID <- function(x) {
      out <- list()
      out$content <- x$content
      out$id <- x$meta$id
      return(out)
    }
    
    newFiles <- sapply(Doc, extractContentID)
    

    【讨论】:

    • 我收到此错误:x$content 中的错误:$ 运算符对原子向量无效
    • 看起来你的 Vcor​​pus 中可能有一个额外的嵌套,它被你提交的文件中的小弹出窗口覆盖。您可以尝试: sapply(Doc[[1]], extractContentID) 在最后一行。但总的来说,重点是编写一个通用函数来提取您想要的元素,然后使用 apply 对该语料库中的每个元素使用该函数。
    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2023-04-08
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2019-10-13
    相关资源
    最近更新 更多