【问题标题】:Find duplicate values in list of tuples in Python在 Python 的元组列表中查找重复值
【发布时间】:2016-07-27 17:47:11
【问题描述】:

如何在以下元组列表中查找重复值?

[(1622, 4081), (1622, 4082), (1624, 4083), (1626, 4085), (1650, 4086), (1650, 4090)]

我想得到一个类似的列表:

[4081, 4082, 4086, 4090]

我尝试使用 itemgetter 然后按选项分组,但没有用。

如何做到这一点?

【问题讨论】:

  • 你能发布你的尝试吗?
  • 使用下面的链接可能会对您有所帮助。 link1link2

标签: python list tuples


【解决方案1】:

使用有序字典,其中第一项作为键,第二项列表作为值(对于使用dict.setdefalt() 创建的重复项),然后选择长度大于 1 的项:

>>> from itertools import chain
>>> from collections import OrderedDict
>>> d = OrderedDict()
>>> for i, j in lst:
...     d.setdefault(i,[]).append(j)
... 
>>> 
>>> list(chain.from_iterable([j for i, j in d.items() if len(j)>1]))
[4081, 4082, 4086, 4090]

【讨论】:

  • +5 谢谢!它的工作完美!没有足够的分数来支持你!
【解决方案2】:

作为替代方案,如果您想使用groupby,可以使用以下方法:

In [1]: from itertools import groupby

In [2]: ts = [(1622, 4081), (1622, 4082), (1624, 4083), (1626, 4085), (1650, 4086), (1650, 4090)]

In [3]: dups = []

In [4]: for _, g in groupby(ts, lambda x: x[0]):
   ...:     grouped = list(g)
   ...:     if len(grouped) > 1:
   ...:         dups.extend([dup[1] for dup in grouped])
   ...:         

In [5]: print(dups)
[4081, 4082, 4086, 4090]

您使用groupby 从元组的第一个元素开始分组,并将重复值从元组添加到列表中。

【讨论】:

    【解决方案3】:

    另一种方法(没有任何导入):

    In [896]: lot = [(1622, 4081), (1622, 4082), (1624, 4083), (1626, 4085), (1650, 4086), (1650, 4090)]
    
    In [897]: d = dict()
    
    In [898]: for key, value in lot:
         ...:     d[key] = d.get(key, []) + [value]
         ...: 
         ...: 
    
    In [899]: d
    Out[899]: {1622: [4081, 4082], 1624: [4083], 1626: [4085], 1650: [4086, 4090]}
    
    In [900]: [d[key] for key in d if len(d[key]) > 1]
    Out[900]: [[4086, 4090], [4081, 4082]]
    
    In [901]: sorted([num for num in lst for lst in [d[key] for key in d if len(d[key]) > 1]])
    Out[901]: [4081, 4081, 4082, 4082]
    

    【讨论】:

      【解决方案4】:

      尚未对此进行测试....(编辑:是的,它有效)

      l = [(1622, 4081), (1622, 4082), (1624, 4083), (1626, 4085), (1650, 4086), (1650, 4090)]
      
      dup = []
      
      for i, t1 in enumerate(l):
          for t2 in l[i+1:]:
              if t1[0]==t2[0]:
                  dup.extend([t1[1], t2[1]])
      print dup
      

      【讨论】:

        猜你喜欢
        • 2012-10-20
        • 1970-01-01
        • 2011-04-17
        • 1970-01-01
        • 1970-01-01
        • 2010-10-10
        • 2018-05-03
        • 1970-01-01
        • 1970-01-01
        相关资源
        最近更新 更多