【问题标题】:Merging dicts with the same keys but different values [duplicate]合并具有相同键但值不同的字典[重复]
【发布时间】:2020-12-18 01:10:31
【问题描述】:

总的来说,我对 python 和开发还很陌生,所以我确信我的问题措辞有点错误。英语也不是我的第一语言,所以如果您想了解更多关于我想做的事情的信息,我很乐意为您解释。

基本上,我有一个字典列表,它们都共享相同的键但不同的值。 例如:

List1 =  [{
'name':'yuval',
'age':16,
'favorite_thing_to_do': 'playing the cello' },

{
'name':'yuval',
'age':16,
'favorite_thing_to_do':'hearing music'},
'name':'shiri',
'age':12,
'favorite_thing_to_do':'watch TV'}]

我正在寻找的输出是一个列表,其中favorite_thing_to_do 尽可能合并。

例如,输出将是

[{'name':'yuval',
'age':16,
'favorite_thing_to_do': ['playing the cello' , 'hearing music']},

{'name':'shiri',
'age':12,
'favorite_thing_to_do':'watch TV'}]

但是,我不知道该怎么做。 我设法定义了一个名为 merge_dict 的函数,它基本上需要两个字典,比较前两个键(姓名和年龄),如果值相同,它返回一个字典,其中 favorite_thing_to_do 是不同值的列表在函数接收到的两个不同的字典中。

作为一个概念,功能很好用;但是,我不知道如何在包含 100 多个未过滤字典的列表上运行此函数; 有没有更简单的方法?

编辑: 我将包括到目前为止我已经完成的相关代码。 我不知道如何在列表中做我想做的事,所以我只声明了两个字典:Item3、Item4,我的函数 merge_dict 集中:

Item3 = {
'name':'shiri',
'age':12,
'favorite_thing_to_do':'watch TV'}

Item4 = {
'name':'shiri',
'age':12,
'favorite_thing_to_do': 'listening to teachers'

 }

def merge_dict(dict1, dict2):
# we know that dict1 and dict2 are the same length, same keys.
    dict3 = {}

    for i in dict1:
        if dict1[i] == dict2[i]:
            dict3[i] = dict1[i]

    if i == 'favorite_thing_to_do':
        if isinstance(dict1[i], str) and isinstance(dict2[i],str) :
            dict3[i] = [dict1[i] , dict2[i]]

        if isinstance(dict1[i], list) and isinstance(dict2[i],str):
            dict3[i] = dict1[i] + [dict2[i]]

        if isinstance(dict1[i], str) and isinstance(dict2[i],list):
            dict3[i] = [dict1[i]] + dict1[i]

        if isinstance(dict1[i], list) and isinstance(dict2[i],list):
            dict3[i] = dict1[i] + dict1[i]

return dict3


print(merge_dict(Item3, Item4))
>>> {'name': 'shiri', 'age': 12, 'favorite_thing_to_do': ['watch TV', 
'listening to teachers']}

【问题讨论】:

  • 你能显示你到目前为止尝试过的代码吗?
  • 当然。我要更新帖子了。

标签: python list dictionary merge


【解决方案1】:

你可以这样做:

List1 =  [{
'name':'yuval',
'age':16,
'favorite_thing_to_do': 'playing the cello' },
{
'name':'yuval',
'age':16,
'favorite_thing_to_do':'hearing music'},
{'name':'shiri',
'age':12,
'favorite_thing_to_do':'watch TV'}]


def merge_dict(dictionary,merged_dict):
    name = dictionary.get('name')
    age = dictionary.get('age')
    favorite = dictionary.get('favorite_thing_to_do')

    #var to inform if needed to write a new dict:
    found_item = False

    # if merged_dict list is empty create the first dict:
    if len(merged_dict)==0:
        merged_dict.append({'name':name, 'age':age,'favorite_thing_to_do':[favorite] })

    # if  merged_dict list is not empty,
    else:
        #look for name and age in all dicts of merged_dict:
        for registred_dict in merged_dict:
            #If found => Append favorite_thing_to_do
            if registred_dict.get('name') == name and registred_dict.get('age')==age:
                registred_dict['favorite_thing_to_do'].append(favorite)
                found_item=True

        #If not found create a new dict in merged_dict:
        if not found_item:
            merged_dict.append({'name':name, 'age':age,'favorite_thing_to_do':[favorite] })


merged_dict = []
for dictionary in List1:
    merge_dict(dictionary,merged_dict)
print(merged_dict)

Item4 = {
'name':'shiri',
'age':12,
'favorite_thing_to_do': 'listening to teachers'
 }
merge_dict(Item4,merged_dict)
print(merged_dict)

结果先打印:

[{'name': 'yuval', 'age': 16, 'favorite_thing_to_do': ['playing the cello', 'hearing music']}, {'name': 'shiri', 'age': 12, 'favorite_thing_to_do': ['watch TV']}]

Item4合并后的结果:

[{'name': 'yuval', 'age': 16, 'favorite_thing_to_do': ['playing the cello', 'hearing music']}, {'name': 'shiri', 'age': 12, 'favorite_thing_to_do': ['watch TV', 'listening to teachers']}]

【讨论】:

    【解决方案2】:

    我发现我错过了姓名和年龄部分。这是一个变体,其中我使用名称和年龄的元组作为键,使用字典作为值。

    已编辑以按照要求的格式显示结果(尽管只返回名称可能会更好):

    def merge(dirs):
        names = {}
        for d in dirs:
            if (d['name'], d['age']) not in names:
                names[(d['name'], d['age'])] = {}
            for k in d:
                if k not in ('name', 'age'):
                    if k not in names[(d['name'], d['age'])]:
                        names[(d['name'], d['age'])][k] = set([])
                    names[(d['name'], d['age'])][k].add(d[k])
      # return names
        return [{'name':k[0], 'age':k[1], 'favorite_things_to_do': 
             list(v2) } for k, v in names.items() for v2 in v.values() ]
    
    print(merge(List1))
    

    【讨论】:

    • 感谢您的回答!我测试了它,它似乎大部分都有效。请注意,如果将来有人要使用它,当您声明 result[k] = list(result[k]) 时,它可能会导致一个只有一个值的列表。因此我添加了一个 if 语句 - “if len(result[k]) == 1:result[k] = result[k][0]”。这似乎解决了列表长度为 1 的问题,使代码看起来更漂亮、更清晰。
    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2021-12-15
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多