【发布时间】:2014-05-16 00:35:20
【问题描述】:
我有一个文本消息和一个术语列表。我想创建一个数组来显示在消息中找到了哪些术语。例如:
message = "the quick brown fox jumps over the lazy dog"
terms = ["quick", "fox", "horse", "Lorem", "Ipsum", "the"]
result = idealMethod(message, terms)
=> [1,1,0,0,0,1]
因为“快速”是术语列表中的第一项,并且在消息中,结果中的第一个位置也是 1。这是另一个例子:
message2 = "Every Lorem has a fox"
result2 = idealMethod(message2, terms)
=> [0,1,0,1,0,0]
更新: 这些术语需要完全匹配。例如,如果我的搜索词包含 sam 我不想匹配 same
【问题讨论】:
-
大概想看看python NLTK
-
您是在使用 0 和 1 作为布尔值,其中 1 仅表示出现的术语,还是在寻找计数?也许添加这条消息作为示例会有所帮助:
"The quick fox beat the slow fox in a race". -
@Matthew 的 0 和 1 代表已找到和未找到。我会更新问题以澄清
标签: python search text data-analysis