【发布时间】:2015-12-29 04:14:45
【问题描述】:
假设,我有两个索引,从各自的 MySQL 表创建。
folder: folder_id, resume_id, status
resume: resume_id, title, skills, experience etc...
在resume_id的基础上,我想要很少的需要JOIN的数据。如果需要,我们可以在索引中设置自动递增字段。
据我说,我可以选择的选项是:
1. 索引合并:我不想合并索引,因为它会占用很多空间。我有数十亿的数据。
2. 加入表格后创建一个索引。此解决方案的问题在于,一个文件夹有许多简历,而一份简历可以在许多其他文件夹中(多对多)。所以,同一份简历的数据会被多次索引,从而造成数据冗余。
如果可能的话,请在 sphinx 中提出一种方法来实现这一点,同时保持性能并减少数据冗余。我必须在拥有数十亿数据的生产环境中使用它。在此先感谢:)
【问题讨论】:
标签: mysql search indexing sphinx thinking-sphinx