【发布时间】:2014-09-24 00:19:05
【问题描述】:
这是我的问题:
我有一个名为 product_id 的字段,格式类似于:
A+B-12321412
如果我使用标准文本分析器,它会将其拆分为如下标记:
/_analyze/?analyzer=standard&pretty=true" -d '
A+B-1232412
'
{
"tokens" : [ {
"token" : "a",
"start_offset" : 1,
"end_offset" : 2,
"type" : "<ALPHANUM>",
"position" : 1
}, {
"token" : "b",
"start_offset" : 3,
"end_offset" : 4,
"type" : "<ALPHANUM>",
"position" : 2
}, {
"token" : "1232412",
"start_offset" : 5,
"end_offset" : 12,
"type" : "<NUM>",
"position" : 3
} ]
}
理想情况下,我想有时搜索确切的产品 ID,有时使用子字符串,或者只是查询部分产品 ID。
我对映射和分析器的理解是,我只能为每个字段指定一个分析器。
有没有办法将字段存储为已分析和完全匹配?
【问题讨论】:
标签: indexing lucene elasticsearch