【问题标题】:How to speed up a concurrent Lucene application?如何加速并发 Lucene 应用程序?
【发布时间】:2012-03-04 17:39:24
【问题描述】:

我的用户正在向我的应用程序提交文档以更新索引,其他用户可以查询该索引。与爬虫不同,索引是间歇性的——仅在用户提交文档时索引。我期望索引搜索多于索引写入操作。 (我没有使用 Solr,因为这对我的需要来说太过分了)并且没有删除或更新索引文档。

这是我将文档添加到索引并从索引中读取的代码。如何进一步优化?

public void addDocument(Document doc) throws CorruptIndexException, LockObtainFailedException, IOException{

    IndexWriterConfig iwc = new IndexWriterConfig(Version.LUCENE_35, new StandardAnalyzer(Version.LUCENE_35)).setIndexDeletionPolicy(NoDeletionPolicy.INSTANCE).setRAMBufferSizeMB(256.0);
    TieredMergePolicy tmp = new TieredMergePolicy();
    tmp.setUseCompoundFile(false);
    tmp.setMaxMergedSegmentMB(1000000.0);
    //tmp.setReclaimDeletesWeight(3.0);
    //tmp.setMaxMergedSegmentMB(7000.0);
    iwc.setMergePolicy(tmp);
    // Make sure merges run @ higher prio than indexing:
    final ConcurrentMergeScheduler cms = (ConcurrentMergeScheduler) iwc.getMergeScheduler();
    cms.setMergeThreadPriority(Thread.currentThread().getPriority() + 2);
    cms.setMaxThreadCount(1);
    cms.setMaxMergeCount(4);



    IndexWriter iw = new IndexWriter(directory, iwc);
    iw.addDocument(doc);
    iw.close();
}

当一个搜索请求进来时,我创建一个新的IndexSearcher如下

public IndexSearcher getIndexSearcher() throws CorruptIndexException, IOException {

        IndexSearcher is= new IndexSearcher(IndexReader.open(directory, false));
        return is;
    }

// 然后我将搜索器用于此处未显示的实际查询

【问题讨论】:

    标签: java concurrency lucene


    【解决方案1】:

    保留 IndexWriters 和 IndexReader。不要为了添加单个文档而打开新的编写器并关闭它。不要仅仅为了响应一个查询而打开新的阅读器,而是使用 SearcherManager 或 NRTManager。

    【讨论】:

    • 那么我应该为 IndeWriter 实例化一个单例并在每次写入时重用它吗?如果我不关闭它,我如何确保写入保存到索引中。
    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 2014-01-29
    • 1970-01-01
    • 2017-01-25
    • 1970-01-01
    • 2013-02-18
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多