【发布时间】:2013-08-16 15:46:27
【问题描述】:
我在 ElasticSearch 字段中有一个字段,我不想对其进行分析,即。 e.它应该被存储并逐字比较。这些值将包含字母、数字、空格、破折号、斜线以及可能的其他字符。
如果我没有在我的映射中为该字段提供分析器,默认情况下仍使用分词器,它将我的逐字字符串破解成词块。我不想那样。
有没有一个超级简单的分析器,基本上不分析?或者是否有不同的方式表示该字段不应被分析?
我只创建索引,我不做任何其他事情。我可以将“english”之类的分析器用于其他字段,这些字段似乎是预配置分析器的内置名称。有其他名字的列表吗?也许有一个适合我的需求(即对输入什么都不做)。
这是我目前的映射:
{
"my_type": {
"properties": {
"my_field1": { "type": "string", "analyzer": "english" },
"my_field2": { "type": "string" }
}
}
}
my_field1 依赖于语言;这似乎有效。 my_field2 应逐字记录。我想在那里提供一个分析器,它根本不做任何事情。
my_field2 的示例值为 "B45c 14/04"。
【问题讨论】:
标签: elasticsearch token analyzer verbatim