【问题标题】:How to merge nested tuples如何合并嵌套元组
【发布时间】:2011-08-17 20:10:31
【问题描述】:

我有一组嵌套元组:

('id', ('name', ('name_float_fml',)), ('user', ('email',)), ('user', ('last_login',)))

我想合并具有相似前缀的列表,结果是:

('id', ('name', ('name_float_fml',)), ('user', ('email','last_login')))

这是另一个例子:

(('baz', ('bing', ('fizz', 'frozz', ('frazz', ('fry', 'bleep', 'blop'))))), ('baz', ('zap', ('zang',))), 'foo', 'bar')

将被合并到:

(('baz', (('bing', ('fizz', 'frozz', ('frazz', ('fry', 'bleep', 'blop')))), ('zap', ('zang')))), 'foo', 'bar')

这些用于存储从根到树叶的路径:

  • 'baz' -> 'bing' -> 'fizz',又名。 ('baz' ('bing' ('fizz,)))
  • 'baz' -> 'zap' -> 'zang',又名('baz' ('zap', ('zang',)))
  • 'baz' -> 'bing' -> 'frazz' -> 'blop',又名('baz', ('bing', ('frazz', ('blop,))))

我想合并通过相同路径到达叶子的元素。我希望这能提供一些澄清。

我已经编写了一些代码来执行此操作,但它很丑陋、冗长,而且可能很脆弱。是否有一些通用、简洁和/或有效的方法来做到这一点?我想可能有某种 itertools 魔法我不知道它会提供一些优雅的解决方案。

注意:我使用的是python 2.4

【问题讨论】:

  • 那些是元组而不是列表。另外,如果你只有 1 和 2 元组,你应该把它们变成 dicts
  • 听起来像是reduce 的工作!
  • 同意,正如所展示的,这些不是列表,但它们很可能是。我已经更改了术语以匹配我的示例。字典不是一个选项,因为在我的用例中,列表或元组是必需的。这些列表可以嵌套到任意深度。
  • 你的第一个元组有一个字符串(id)和另外三个元组。应该如何处理?里面可以有更多的元组层,还是只有两个?
  • 我有兴趣查看另一个示例输入和输出集。

标签: python merge tree


【解决方案1】:

这是适用于您发布的示例的版本:

a = ('id', ('name', ('name_float_fml',)), ('user', ('email',)), ('user', ('last_login',)))
b = (('baz', ('bing', ('fizz', 'frozz',('frazz', ('fry', 'bleep', 'blop'))))), ('baz', ('zap', ('zang',))), 'foo', 'bar')

def preserve_path(value):
    if len(value) == 2 and isinstance(value[1], (list, tuple)):
        return [value]
    else:
        return value

def flatten_group(my_list):
    d = {}
    for item in my_list:
        # Only items with one string, followed by one tuple represent a path
        # segment. In all other situations, strings are leaves.
        if isinstance(item, (list, tuple)) and len(item) == 2:
            key, value = item
            if key in d:
                d[key].extend(flatten_group(preserve_path(value)))
            else:
                d[key] = preserve_path(list(flatten_group(value)))
        else:
            yield item

    for item in d.iteritems():
        yield item

print list(flatten_group(a))
# ['id', ('name', ['name_float_fml']), ('user', ['email', 'last_login'])]
print list(flatten_group(b))
# ['foo', 'bar', ('baz', [['bing', ('fizz', 'frozz', ('frazz', ('fry', 'bleep', 'blop')))], ('zap', ['zang'])])]

编辑 3: 更新了适用于这两个示例的共同创作版本,并包含您的限制,即它只需要考虑合并元组/列表并包含两个项目的项目。这也可以防止合并项目的额外展平。

【讨论】:

  • +1,这看起来不错。我仍然认为有一个groupby 解决方案,但我无法为它计算出递归。
  • 不幸的是,我使用的是 python 2.4,其中 collections.defaultdict 尚不存在。
  • 更新为检查密钥并采取适当的行动,而不是使用defaultdict。还删除了一个不必要的list 调用。
  • 这看起来可以解决问题,尽管我必须为你定义 d ;o)
  • 我的第二个示例可能没有提供足够的信息。您的代码对此感到窒息,因为它假定每个元组中只有两个元素,这是无法保证的。例如,'zang' 是示例 #2 中其元组的唯一成员。为了清楚起见,我将更新我的示例。
【解决方案2】:

这是一个递归函数:

def merge(x, bases = (tuple, list)):
    for e in x:
        if type(e) in bases:
            for e in merge(e, bases):
                yield e
        else:
            yield e

tup = (0, (1, 3, 2), [5, (7, 2)])

print list(merge(tup))
# [0, 1, 3, 2, 5, 7, 2]

【讨论】:

  • 我认为你误解了我在寻找什么。我不想只是扁平化列表。
【解决方案3】:

这是一个使用itertools.groupby的解决方案:

from itertools import groupby
def combine(tuples):
    rlist = [tuples[0]]
    for k, g in groupby(tuples[1:], key=lambda t: t[0]):
        rlist.append(tuple((k, tuple(gg[1:][0][0] for gg in g))))
    return tuple(rlist)

sample = ('id', ('name', ('name_float_fml',)), ('user', ('email',)), ('user', ('last_login',)))
print combine(sample)
# ('id', ('name', ('name_float_fml',)), ('user', ('email', 'last_login')))

对于比您的问题中给出的更复杂的示例,此过程的递归应用是可能的。

【讨论】:

    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 2019-05-26
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2022-01-15
    • 1970-01-01
    相关资源
    最近更新 更多