【发布时间】:2012-01-14 14:21:12
【问题描述】:
我想找到一种方法来从包含与我输入的单词最相似的单词的表中找到最合适的行。任何的想法? (我使用的 OCR 会发现不完全相同的单词有时会将单词 'specific' 读取为 'spccific')
【问题讨论】:
标签: sql sql-server algorithm word fuzzy-comparison
我想找到一种方法来从包含与我输入的单词最相似的单词的表中找到最合适的行。任何的想法? (我使用的 OCR 会发现不完全相同的单词有时会将单词 'specific' 读取为 'spccific')
【问题讨论】:
标签: sql sql-server algorithm word fuzzy-comparison
如果您使用的是 Oracle,那么您可以尝试 UTL_MATCH,它使用称为 Levenshtein Distance 的东西来计算将一个字符串转换为另一个字符串的最小编辑次数。其他系统可能有类似的东西,或者您可以使用该算法作为您自己功能的起点。
【讨论】:
如果您使用的 SQL 引擎可以使用 SOUNDEX 功能 (SQL Server) 或 SOUNDS LIKE (MySQL),也许您可以使用它。
【讨论】: