【问题标题】:How to read a stop word list from a text file in R [duplicate]如何从R中的文本文件中读取停用词列表[重复]
【发布时间】:2012-11-17 03:35:58
【问题描述】:

可能重复:
Read a Text File into R

我有一个自定义停用词列表,它位于以换行符分隔的文本文件中。如何在我的 R 脚本中使用该文件?

代码:

my_stopwords <- c(stopwords(),"aint","wanna","gonna",...)

唯一的问题是我想从文件中读取单词,而不是像上面那样对它们进行硬编码。我的文本文件如下所示:

"aint"
"wanna"
"gonna"
...

提前致谢。

【问题讨论】:

    标签: r text-mining stop-words


    【解决方案1】:

    readLines 可以在这里工作:

    con <- file("filename.txt", "r")
    readLines(con)
    

    虽然现在您指定单词是“引用”的,但这可能不是一个很好的解决方案,您最好使用read.csv("filename.txt")

    【讨论】:

      【解决方案2】:

      从技术上讲,换行分隔的文件可以被视为有效的 CSV 文件。尝试read.csv() 将列表作为data.frame 获取。您可能想unlist 它或仅访问第一列以将其放入数组中,就像您所拥有的一样。

      【讨论】:

      • 谢谢,我现在可以读取文件了,但是我怎样才能得到它的第二列,因为第一列包含行数,我不想要它。
      • readCSV 甚至不是基本 R 中的函数。我认为您正在寻找 read.csv
      • @Sina:打印数据框时看到的行号实际上并未被视为列。获取数据框的第一列,例如与df[, 1],应该仍然给你的话。
      猜你喜欢
      • 2017-06-21
      • 2012-05-05
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 2013-12-18
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      相关资源
      最近更新 更多