【问题标题】:Word search within texts to find text that contains most matched variant在文本中进行单词搜索以查找包含最匹配变体的文本
【发布时间】:2012-01-14 14:21:12
【问题描述】:

我想找到一种方法来从包含与我输入的单词最相似的单词的表中找到最合适的行。任何的想法? (我使用的 OCR 会发现不完全相同的单词有时会将单词 'specific' 读取为 'spccific')

【问题讨论】:

    标签: sql sql-server algorithm word fuzzy-comparison


    【解决方案1】:

    如果您使用的是 Oracle,那么您可以尝试 UTL_MATCH,它使用称为 Levenshtein Distance 的东西来计算将一个字符串转换为另一个字符串的最小编辑次数。其他系统可能有类似的东西,或者您可以使用该算法作为您自己功能的起点。

    【讨论】:

    • 不幸的是,我正在使用 mssql。但我会尝试编写一个 utl_match 所做的函数。但我希望 mssql 中有相同的功能 :(
    【解决方案2】:

    如果您使用的 SQL 引擎可以使用 SOUNDEX 功能 (SQL Server) 或 SOUNDS LIKE (MySQL),也许您可​​以使用它。

    【讨论】:

    • 语音不是一个好的解决方案。另外,数据库的语言不是英语
    猜你喜欢
    • 2021-10-25
    • 1970-01-01
    • 2017-04-15
    • 1970-01-01
    • 2013-05-27
    • 2018-06-14
    • 2021-09-12
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多