【发布时间】:2012-09-20 22:18:16
【问题描述】:
我编写了一个 C++ 程序来查询 100 GB 的字典。我已将字典拆分为 n 个大小相等的文件。所有拆分文件都放在同一个目录中。字典是完全索引的,即,一旦有查询,我就知道要打开哪个 spit 文件以及在哪里寻找。我的问题是为了获得更好的性能,哪个拆分会更好: (a) 少量大文件或 (b) 大量小文件? 另外,理想的分裂是什么?
【问题讨论】:
-
理想情况下,您会在正确实施的数据库中使用索引表。以 SQLite 为例,它可以嵌入到您自己的 C++ 代码中。
标签: c++ performance file file-access