【发布时间】:2018-02-08 10:00:51
【问题描述】:
我对机器学习算法完全陌生,我有一个关于数据集分类的快速问题。
目前有一个训练数据由两列 Message 和 Identifier 组成。
消息 - 从包含时间戳和一些文本的日志中提取的典型消息 标识符 - 应根据消息内容对类别进行分类。
通过从工具中提取特定类别并相应地标记它来准备训练数据。
现在测试数据只包含消息,我正在尝试相应地获取类别。
在这种情况下哪种方法最有帮助?是监督学习还是非监督学习?
我有一个训练有素的数据集,我正在尝试预测测试数据的类别。
提前致谢, 亚当
【问题讨论】:
标签: machine-learning classification cluster-analysis data-mining