【发布时间】:2011-01-14 21:08:45
【问题描述】:
我正在使用 solr 的 faceting,我遇到了一个问题,我希望我可以使用过滤器来解决。
基本上有时一个城镇名称会通过 SOLR 作为
“剑桥”
有时它会通过
“剑桥”
我想在 Solr 中使用过滤器来阻止 SCREAMING CAPS 版本的城镇名称。似乎有一个 fitler 来制作所有的文字lower case。
<!-- A text field that only sorts out casing for faceting -->
<fieldType name="text_facet" class="solr.TextField" positionIncrementGap="100">
<analyzer type="index">
<tokenizer class="solr.WhitespaceTokenizerFactory"/>
<filter class="solr.LowerCaseFilterFactory"/>
</analyzer>
<analyzer type="query">
<tokenizer class="solr.WhitespaceTokenizerFactory"/>
<filter class="solr.LowerCaseFilterFactory"/>
</analyzer>
</fieldType>
我想知道是否有人知道过滤器会忽略单词的第一个字符并将小写字母应用于其余字符。例如
- 剑桥 >> 剑桥
- 赫尔河畔金斯敦 >> 赫尔河畔金斯敦
等
或者,如果编写自己的过滤器很容易.. 一些关于如何做到这一点的帮助将不胜感激.. 我不是 Java 人..
谢谢
【问题讨论】:
标签: lucene solr filterfactory