【发布时间】:2015-09-15 12:16:22
【问题描述】:
我需要在 c# 中使用 wordnet API 在字典中搜索单词。我正在收集来自巴基斯坦地区的推文,它们是英语和罗马乌尔都语的混合体。我需要将英语推文与罗马乌尔都语推文分开。这样做的最佳方法是什么? 谁能帮忙??????
【问题讨论】:
-
我不知道
wordnet,但语言分离是一个复杂的问题,可以通过不同的方式解决。一些常见的方法是Neural-Networks,Alpha-Bet occurences statistics或字典搜索中的简单单词,但是当您的轮询数据较小时,后者的错误率会更高。 -
罗马乌尔都语包含用英语字母拼写的单词,所以我需要在字典中搜索这些单词,如果发现这意味着它们属于英语,如果不是则意味着它们属于罗马乌尔都语。你知道通过c#在字典中搜索单词的任何方法吗?
-
必须是 wordnet 还是任何字典?
-
可以是任何字典