【发布时间】:2021-03-12 08:41:05
【问题描述】:
我正在尝试使用 gremlin python 在最短的时间内插入数百万个顶点和边。 我有两件事要考虑: 避免顶点和边的重复 避免花 10 个小时插入所有数据
请求的主要时间是寻找现有顶点并创建关系。 如果我在不检查顶点是否已经存在的情况下插入边,脚本会更快。
我也尝试过批处理交易,例如:
g.addV("person").property("name", "X").as_("p1")
.addV("person").property("name", "Y").as_("p2")
.addE("has_address").from("p1").to(g.V().has("address", "name", "street"))
.addE("has_address").from("p2").to(g.V().has("address", "name", "street2")).iterate()
但我并没有提高性能。
如果有重复,我会在查询中得到相同的结果吗? 我认为对于不重复的查询,以后会更昂贵吗?
谢谢。
【问题讨论】:
标签: python performance duplicates gremlin