【发布时间】:2016-04-29 23:10:14
【问题描述】:
我在 csv 中有 3 个数据集 带有属性的问题.csv:
- 身份证
- 级别
- 准确度
- solved_count
- error_count
- 标签1
- 标签2
- 标签3
- 标签4
- 标签5
带有属性的Submission.csv:
- user_id
- problem_id
- 已解决状态
user.csv 与
- user_id
- solved_count
- 尝试
我现在想在测试数据集上预测用户是否能够解决问题。
我正在考虑应用朴素贝叶斯分类。但我不知道如何解决这个问题。我想我必须在 arff 中制作一个通用数据集,以便与 Weka 或 sckit learn 一起使用。告诉我如何解决这个问题。
【问题讨论】:
标签: machine-learning scikit-learn classification weka naivebayes