【发布时间】:2012-03-16 10:34:43
【问题描述】:
我正在测试一个想法,即使用回波状态网络的分层组合将任何符号序列矢量化为 R^n 中的固定大小矢量。目标是将这些序列分类为向量(有很多机器学习算法可用于固定大小的实向量)。
特别是,我正在用英语单词测试这个算法,试图将它们分类为名词或形容词。我的数据集在这里:http://www.ashley-bovan.co.uk/words/partsofspeech.html
使用 SVM 进行分类,我得到了 9% 的错误,请有人可以指点我相关的论文或结果进行比较?
谢谢!
【问题讨论】:
-
很好的例子——但 90 % 似乎是一个普遍的常数。你能张贴一些错误分类的词吗?什么是 n,如何对 n 向量进行归一化?
标签: machine-learning classification svm words