【发布时间】:2017-09-18 15:14:59
【问题描述】:
我有以下配置:
@AnalyzerDef(name = "autocompleteNGramAnalyzer",
// Split input into tokens according to tokenizer
tokenizer = @TokenizerDef(factory = StandardTokenizerFactory.class),
filters = {
// Normalize token text to lowercase, as the user is unlikely to
// care about casing when searching for matches
@TokenFilterDef(factory = WordDelimiterFilterFactory.class),
@TokenFilterDef(factory = LowerCaseFilterFactory.class),
@TokenFilterDef(factory = EdgeNGramFilterFactory.class, params = {
@Parameter(name = "minGramSize", value = "2"),
@Parameter(name = "maxGramSize", value = "5") }) })
这几乎可以按预期工作,但包含数字的单词会出现问题。
例如:
byabtoken lucene 返回abcdefg,但如果我需要找到
a1 和 a1b1c1d1 它不返回任何东西
如何更改此配置?
【问题讨论】:
标签: java indexing lucene hibernate-search