【问题标题】:Quickly check if a list is a sublist, of one of the elements of a nested list快速检查列表是否为嵌套列表元素之一的子列表
【发布时间】:2013-11-08 22:58:00
【问题描述】:

作为 SAT 求解器的结果,我有一个逻辑公式模型的大型嵌套 int 列表。 该列表有 100 万个长度约为 30 的子列表。

示例数据:

[[-1, -2, 3, -4, -5, 6, 7, -8, -9, -10, -11, -12, 13, 14, 15, -16, 17, -18, -19, -20, 21, 22, 23, 24, 25, -26, -27, 28, 29, 30, -31, 32, 33, -34, 35, 36, -37], [-1, -2, 3, -4, -5, 6, 7, -8, -9, -10, -11, -12, 13, 14, 15, -16, 17, -18, -19, -20, 21, 22, 23, 24, 25, -26, -27, 28, 29, 30, -31, 32, 33, -34, 35, 36, 37], [-1, -2, 3, -4, -5, 6, 7, -8, -9, -10, -11, -12, 13, 14, 15, -16, 17, -18, -19, -20, 21, 22, 23, 24, 25, -26, -27, 28, 29, 30, -31, 32, 33, 34, 35, 36, -37], [-1, -2, 3, -4, -5, 6, 7, -8, -9, -10, -11, -12, 13, 14, 15, -16, 17, -18, -19, -20, 21, 22, 23, 24, 25, -26, -27, 28, 29, 30, -31, 32, 33, 34, 35, 36, 37], [-1, -2, 3, -4, -5, 6, 7, -8, -9, -10, -11, -12, 13, 14, 15, -16, 17, -18, -19, -20, 21, 22, 23, 24, 25, -26, -27, 28, 29, 30, -31, 32, 33, 34, -35, 36, -37], [-1, -2, 3, -4, -5, 6, 7, -8, -9, -10, -11, -12, 13, 14, 15, -16, 17, -18, -19, -20, 21, 22, 23, 24, 25, -26, -27, 28, 29, 30, -31, 32, 33, 34, -35, 36, 37], [-1, -2, 3, -4, -5, 6, 7, -8, -9, -10, -11, -12, 13, 14, 15, -16, 17, -18, -19, -20, 21, 22, 23, 24, 25, -26, -27, 28, 29, 30, 31, 32, 33, 34, -35, 36, -37], [-1, -2, 3, -4, -5, 6, 7, -8, -9, -10, -11, -12, 13, 14, 15, -16, 17, -18, -19, -20, 21, 22, 23, 24, 25, -26, -27, 28, 29, 30, 31, 32, 33, 34, -35, 36, 37]]

我需要检查一个列表,比如 [4,5,6] 是否包含属于其中一个嵌套列表的元素。

说我的清单是:

[ [5,12,46,4,99,6],[23,66,99,32,77] ]

如果我用

运行我的程序
[4,5,6]

它应该返回true

因为我需要使用不同的列表执行 500 次测试,所以我猜问题是性能关键。

这是我的计划:

  • 对要检查的列表进行排序
  • 对大嵌套列表进行排序
  • 总是先比较两个最小的数字(比如我搜索 2 并且子列表以 3 开头,我可以继续下一个子列表)

或者有没有更好的方法,例如使用字典?

(PS:因为我只寻找正数,所以我之前问过this question 以摆脱所有负数。)

【问题讨论】:

  • 作为第一步,您应该真正使用 Python set 数据结构,因为成员资格是您需要的标准,而不是任何订购信息。特别是,set.issubset 方法可能是一个足够有效的实现来解决您的问题。

标签: python performance list


【解决方案1】:

使用集:

>>> data = [ [5,12,46,4,99,6],[23,66,99,32,77] ]
>>> set_data = [set(s) for s in data]
>>> set_data
[set([99, 4, 5, 6, 12, 46]), set([32, 66, 99, 77, 23])]
>>> myset = set([4,5,6])
>>> [myset.issubset(s) for s in set_data]
[True, False]

【讨论】:

  • 我只需要在找到第一个“真”后停下来。那么我是否使用 foreach 循环?
【解决方案2】:

不要使用在内存中不必要地创建一个全新列表的列表推导,使用带有 any() 的生成器表达式。以 Visser 的代码为起点:

>>> data = [ [5,12,46,4,99,6],[23,66,99,32,77] ]
>>> set_data = [set(s) for s in data]
>>> set_data
[set([99, 4, 5, 6, 12, 46]), set([32, 66, 99, 77, 23])]
>>> myset = set([4,5,6])
>>> any(myset.issubset(s) for s in set_data)
True

【讨论】:

    猜你喜欢
    • 2013-03-01
    • 1970-01-01
    • 2021-08-24
    • 1970-01-01
    • 2019-08-11
    • 2020-05-18
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多