【发布时间】:2019-10-09 22:43:24
【问题描述】:
我有一个非常大的数据集,接近 5 亿条边,其中几乎所有边都需要遍历。我试图通过在 IDS 上分页来并行化这些遍历。我的策略是尝试按 MD5 哈希的 ID 进行分页。我尝试了如下查询:
g.E().hasLabel('foo').has(id, TextP.startingWith('AAA')) 第 1 页
g.E().hasLabel('foo').has(id, TextP.startingWith('AAB')) 第 2 页
但每个查询似乎都在进行全面扫描,而不仅仅是一个子集。你建议我如何进行分页?
【问题讨论】:
标签: gremlin tinkerpop amazon-neptune