【发布时间】:2015-02-07 08:35:43
【问题描述】:
我使用未更改的电影镜头数据文件 (ml-100k.zip) u.data,因此它具有以下列:用户 ID、电影 ID 和用户评分。
我用过 LLR:
hadoop jar C:\hdp\mahout-0.9.0.2.1.3.0-1981\core\target\mahout-core-0.9.0.2.1.3.0-1981-job.jar org.apache.mahout.cf .taste.hadoop.item.RecommenderJob -s SIMILARITY_LOGLIKELIHOOD --input u.data --output udata_output
当我查看 udata_output 文件时,我看到推荐的电影 ID 后跟推荐分数,例如:
1226:5.0 和 896:4.798878
推荐分数似乎从 5.0 到 4.x 不等
但是,当我从 u.data 文件中删除用户评分列并重新运行上面相同的命令行时,我收到的结果如下:
615:1.0
所有推荐分数均为 1.0。
2 个问题:
1) 如果 LLR 忽略用户评分,我唯一改变的输入是是否提供用户评分,为什么推荐分数会改变?
2) 总的来说,我正在尝试确定推荐排名,因此我使用的是 LLR。另外我是否应该忽略推荐分数而只关注推荐项目的顺序(例如:第一个项目的排名高于第二个)?
提前致谢。
【问题讨论】: