【发布时间】:2012-11-30 03:53:46
【问题描述】:
对于真正的大数据(例如超过 2^32 个元素和超过 2^32 对联合),是否有任何增强的不相交集算法?
显然最大的问题是我无法制作这么大的数组,所以我想知道是否有更好的算法或更好的数据结构来完成我的任务?
【问题讨论】:
标签: algorithm bigdata disjoint-sets union-find
对于真正的大数据(例如超过 2^32 个元素和超过 2^32 对联合),是否有任何增强的不相交集算法?
显然最大的问题是我无法制作这么大的数组,所以我想知道是否有更好的算法或更好的数据结构来完成我的任务?
【问题讨论】:
标签: algorithm bigdata disjoint-sets union-find
处理真正大数据的一种方法是在外部存储器中运行。 http://terrain.cs.duke.edu/pubs/union-find.pdf (I/O-Efficient Batched Union-Find and Its Applications to Terrain Analysis) 包含一个理论算法,由对其他批处理算法的相当复杂的调用序列组成,以及(第 3 节)一个自包含的递归算法这不是渐近有效的,但看起来似乎很实用。
【讨论】: