首先,您可以尝试使用全文索引进行模糊匹配,看看是否能解决问题。
一个例子是:
设置索引——
CALL db.index.fulltext.createNodeIndex('jobs', ['Job'], ['name'], {})
用模糊匹配查询索引(注意~)
CALL db.index.fulltext.queryNodes('jobs', 'fynancial~')
如果您想更进一步并使用 Lucene 的语音搜索,那么您可以编写一些 Java 代码来注册一个自定义分析器。
像这样包含lucene-analyzers-phonetic 依赖项:
<dependency>
<groupId>org.apache.lucene</groupId>
<artifactId>lucene-analyzers-phonetic</artifactId>
<version>8.5.1</version>
</dependency>
然后创建一个自定义分析器:
@ServiceProvider
public class PhoneticAnalyzer extends AnalyzerProvider {
public PhoneticAnalyzer() {
super("phonetic");
}
@Override
public Analyzer createAnalyzer() {
return new Analyzer() {
@Override
protected TokenStreamComponents createComponents(String s) {
Tokenizer tokenizer = new StandardTokenizer();
TokenStream stream = new DoubleMetaphoneFilter(tokenizer, 6, true);
return new TokenStreamComponents(tokenizer, stream);
}
};
}
}
我使用了 DoubleMetaphoneFilter,但您可以尝试其他人。
打包成jar,和Lucene phonetic jar一起放到Neo4j的插件目录下,重启服务器。
然后,使用这个分析器创建一个全文索引:
CALL db.index.fulltext.createNodeIndex('jobs', ['Job'], ['name'], {analyzer:'phonetic'})
查询索引看起来一样:
CALL db.index.fulltext.queryNodes('jobs', 'fynancial')