【发布时间】:2020-06-04 13:09:53
【问题描述】:
我在使用带有“模式”标记器的“keep_types”过滤器时遇到问题,这是一个示例:
{
"tokenizer": {
"type": "pattern",
"pattern": "[()., _-]"
},
"filter": [
"lowercase",
"asciifolding",
{
"type": "keep_types",
"types": [
"<ALPHANUM>"
]
}
],
"text": [
"7002982065_8031949292_Bomba (Vácuo,pressão) - Suryha.pdf"
]
}
针对 _analyze API 的结果是:
{
"tokens": []
}
如果我删除 keep_types,它会按预期工作。
我还注意到,如果我使用“标准”分析器,它可以正常工作,但在这种情况下,它不会以所需的方式标记文本。
我使用的是 6.8 版本,但也在 7.5 中尝试过,结果相同...
有什么想法吗?
【问题讨论】:
标签: elasticsearch elasticsearch-analyzers