【发布时间】:2019-01-29 18:30:30
【问题描述】:
我有一个包含两列 order_id 和 product_id 的 CSV 文件。该文件有大约 140k 行。
以下是文件中的一些示例数据:
"order_id","product_id"
"801135853641","1410535456841"
"778925670473","120742871041"
"889236947017","54238412801"
"774614614089","1410073886793"
"810056155209","1293186957385"
我想对此进行先验分析,因此使用read.transactions 将其作为事务对象读入。
代码是
library(arules)
trans = read.transactions(file_location,
format = "single",
sep = ",",
cols = c("order_id", "product_id"))
当我运行它时,我得到了错误
validObject(.Object) 中的错误: 无效的类“ngTMatrix”对象:TsparseMatrix 中的所有行索引(槽 'i')必须介于 0 和 nrow-1 之间
尝试了几次搜索,但找不到任何解决方案。任何帮助将不胜感激。
【问题讨论】:
-
使用示例数据似乎对我有用。确保您拥有最新版本的 arules。请在github.com/mhahsler/arules/issues 使用完整数据打开一个问题。
-
放弃调试,改用
as(...,"transactions")。也就是说,这很可能只是一个版本问题,因为我在发布后不久就升级了 R 版本。