【问题标题】:Algorithm for textual context matching in JavascriptJavascript中文本上下文匹配的算法
【发布时间】:2015-03-29 04:03:18
【问题描述】:

我必须将算法实现为 Node.js 应用程序,我将在其中获取字符串,并根据它们的上下文来决定它是否匹配。以出租车服务为例。一个叫出租车的人可以被认为是第一个。愿意提供服务的出租车司机可以被认为是 string2。该算法应该处理这两个字符串,并在这种情况下返回一个匹配项。如果需要,我有很多测试数据来训练我的算法。

到目前为止,我遇到了Bayes Document Classification algorithm,我认为它可以完成工作。

我想知道是否有更简单的方法可以做到这一点,或者我可以使用任何现有的 npm 模块?

示例字符串:

S1 : 我在纽约找公寓 S2:我们的网站列出了在纽约出售的公寓。 结果:匹配。

S1 : 我在纽约找餐馆 S2:约翰卖电脑。 结果:不匹配。

【问题讨论】:

  • 你能举一个string1和string2的例子吗?另外,你的数据集是什么样子的,它是如何格式化的等等?

标签: javascript node.js algorithm npm


【解决方案1】:

您可以使用Levenshtein distance,它会为您提供一些更正,以便匹配字符串,您可以将其转换为百分比,转换为approximate the match

Here是JavaScript实现,可以作为nodejs模块使用。

【讨论】:

    猜你喜欢
    • 2016-12-13
    • 2010-11-09
    • 2012-04-20
    • 1970-01-01
    • 1970-01-01
    • 2012-05-01
    • 1970-01-01
    • 2013-12-19
    • 1970-01-01
    相关资源
    最近更新 更多