【发布时间】:2015-07-19 01:09:31
【问题描述】:
我在 Cassandra 上使用 TITAN 0.4,我已经索引了我的密钥(在我的例子中是“ip_address”),但作为非唯一的,以提高性能和可扩展性。 现在的挑战是图允许重复顶点。 我正在运行一个后台任务,通过遍历所有顶点来清理图中的重复顶点。 识别图中重复顶点的最佳方式或方法是什么。 生产中的图估计大小在10M~15M顶点左右,甚至更多。 TITAN 索引中是否存在任何有助于轻松识别重复项的功能? 提前致谢
索引创建 Gremlin 脚本
g.makeKey("ip_address").dataType(String.class).indexed("standard",Vertex.class).make();
【问题讨论】:
标签: graph graph-databases titan gremlin