【发布时间】:2015-10-26 08:26:23
【问题描述】:
我需要在数据结构中存储 2 到 1500 万个帐户(长度为 15 的 String),以用于查找和检查唯一性。最初我计划将它们存储在HashSet 中,但我怀疑查找速度会因为散列冲突而变慢,并且最终会比 TreeMap 慢(使用二进制搜索)。
不需要对数据进行排序。我正在使用 Java 7。我有 64G 系统,其中 48G 专用于此应用程序。
这个问题不是HashSet and TreeSet performance test 的重复问题,因为这个问题是关于向Set 添加元素 的性能,而这个问题是关于检查现有@ 的性能987654326@ 重复值。
【问题讨论】:
-
也可以参考this
-
嗨,Ankuar,谢谢。链接中的性能测试基于已排序的 500K 整数。我有 1000 万个字符串,想了解哈希冲突的可能性。在第二个链接中有提示是 hwlpful。我会尝试将我的观察结果发布回来。
-
查找用于检查特定字符串是否存在于字符串集中。这是一个独立的 java 程序,不能使用 Redis 之类的东西来存储数据。
标签: java performance hashset treeset