【问题标题】:R stm package error: "vectorized sources must have a positive length entry"R stm 包错误:“矢量化源必须具有正长度条目”
【发布时间】:2016-12-10 18:30:51
【问题描述】:

我认为我犯了一个非常简单的错误,但我是 R 的新手,很难弄清楚。我正在尝试使用 R 中的“stm”包对我抓取的推文数据集进行一些主题建模。

数据集被格式化为两列,一列是推文发送者的名称,列标题为“meta”,另一列是推文的词汇,列标题为“vocab”。运行下面的脚本后,我收到以下错误:

Error: is.Source(s) is not TRUE
In addition: Warning message:
In is.Source(s) : vectorized sources must have a positive length entry

library(stm)
library(igraph)
setwd("c:/Users/Adam/Desktop/RTwitter")

data <-read.csv("TweetDataSTM.csv")
processed <- textProcessor(data$documents, metadata = data)
out <- prepDocuments(processed$documents, processed$vocab, processed$meta)
docs <- out$documents
vocab <- out$vocab
meta <-out$meta

> library(stm)
> library(igraph)
> setwd("c:/Users/Adam/Desktop/RTwitter")
> 
> rm(list=ls())
> 
> data <-read.csv("TweetDataSTM.csv")
> processed <- textProcessor(data$documents, metadata = data)
Building corpus... 
Error: is.Source(s) is not TRUE
In addition: Warning message:
In is.Source(s) : vectorized sources must have a positive length entry
> out <- prepDocuments(processed$documents, processed$vocab, processed$meta)
Error in prepDocuments(processed$documents, processed$vocab, processed$meta) : 
  object 'processed' not found
> docs <- out$documents
Error: object 'out' not found
> vocab <- out$vocab
Error: object 'out' not found
> meta <-out$meta
Error: object 'out' not found

(任何建议将不胜感激!)

-亚当

【问题讨论】:

  • 首先逐行运行,找出错误到底发生在哪里。可能是由于某种原因您的数据实际上并未被读取。编辑您的问题以包含数据样本。
  • 谢谢,我已经编辑了我的问题

标签: r topic-modeling


【解决方案1】:

我认为您的错误发生是因为您的列被命名为vocabmeta。但是这里

已处理

您正在尝试调用一个列 documents,据我所知,该列在您的 data.frame 中不存在。尝试将代码更改为:

processed <- textProcessor(data$vocab, metadata = data)

【讨论】:

    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2019-05-04
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多