资讯专栏INFORMATION COLUMN

Python优雅的合并两个Dict

darkbaby123 / 3441人阅读

摘要:一些不够优雅的示范有些人会使用这种方法这其实就是在内存中创建两个列表,再创建第三个列表,拷贝完成后,创建新的,删除掉前三个列表。并且支持优先级。

一行代码合并两个dict

假设有两个dict x和y,合并成一个新的dict,不改变 x和y的值,例如

 
 x = {"a": 1, "b": 2}
 y = {"b": 3, "c": 4}

期望得到一个新的结果Z,如果key相同,则y覆盖x。期望的结果是

>>> z
{"a": 1, "b": 3, "c": 4}

在PEP448中,有个新的语法可以实现,并且在python3.5中支持了该语法,合并代码如下

z = {**x, **y}

妥妥的一行代码。
由于现在很多人还在用python2,对于python2和python3.0-python3.4的人来说,有一个比较优雅的方法,但是需要两行代码。

z = x.copy()
z.update(y)

上面的方法,y都会覆盖x里的内容,所以最终结果b=3.

不使用python3.5如何一行完成了

如果您还没有使用Python 3.5,或者需要编写向后兼容的代码,并且您希望在单个表达式中运行,则最有效的方法是将其放在一个函数中:

def merge_two_dicts(x, y):
    """Given two dicts, merge them into a new dict as a shallow copy."""
    z = x.copy()
    z.update(y)
    return z

然后一行代码完成调用:

 z = merge_two_dicts(x, y)

你也可以定义一个函数,合并多个dict,例如

def merge_dicts(*dict_args):
    """
    Given any number of dicts, shallow copy and merge into a new dict,
    precedence goes to key value pairs in latter dicts.
    """
    result = {}
    for dictionary in dict_args:
        result.update(dictionary)
    return result

然后可以这样使用

z = merge_dicts(a, b, c, d, e, f, g) 

所有这些里面,相同的key,都是后面的覆盖前面的。

一些不够优雅的示范 items

有些人会使用这种方法:

 z = dict(x.items() + y.items())

这其实就是在内存中创建两个列表,再创建第三个列表,拷贝完成后,创建新的dict,删除掉前三个列表。这个方法耗费性能,而且对于python3,这个无法成功执行,因为items()返回是个对象。

>>> c = dict(a.items() + b.items())
Traceback (most recent call last):
  File "", line 1, in 
TypeError: unsupported operand type(s) for +: "dict_items" and 
"dict_items"

你必须明确的把它强制转换成list,z = dict(list(x.items()) + list(y.items())),这太浪费性能了。
另外,想以来于items()返回的list做并集的方法对于python3来说也会失败,而且,并集的方法,导致了重复的key在取值时的不确定,所以,如果你对两个dict合并有优先级的要求,这个方法就彻底不合适了。

>>> x = {"a": []}
>>> y = {"b": []}
>>> dict(x.items() | y.items())
Traceback (most recent call last):
  File "", line 1, in 
TypeError: unhashable type: "list"

这里有一个例子,其中y应该具有优先权,但是由于任意的集合顺序,x的值被保留:

>>> x = {"a": 2}
>>> y = {"a": 1}
>>> dict(x.items() | y.items())
{"a": 2}
构造函数

也有人会这么用

z = dict(x, **y)

这样用很好,比前面的两步的方法高效多了,但是可阅读性差,不够pythonic,如果当key不是字符串的时候,python3中还是运行失败

>>> c = dict(a, **b)
Traceback (most recent call last):
  File "", line 1, in 
TypeError: keyword arguments must be strings

Guido van Rossum 大神说了:宣告dict({}, {1:3})是非法的,因为毕竟是滥用机制。虽然这个方法比较hacker,但是太投机取巧了。

一些性能较差但是比较优雅的方法

下面这些方法,虽然性能差,但也比items方法好多了。并且支持优先级。

{k: v for d in dicts for k, v in d.items()}

python2.6中可以这样

 dict((k, v) for d in dicts for k, v in d.items())
 

itertools.chain:

import itertools
z = dict(itertools.chain(x.iteritems(), y.iteritems()))
性能测试

以下是在Ubuntu 14.04上完成的,在Python 2.7(系统Python)中:

>>> min(timeit.repeat(lambda: merge_two_dicts(x, y)))
0.5726828575134277
>>> min(timeit.repeat(lambda: {k: v for d in (x, y) for k, v in d.items()} ))
1.163769006729126
>>> min(timeit.repeat(lambda: dict(itertools.chain(x.iteritems(),y.iteritems()))))
1.1614501476287842
>>> min(timeit.repeat(lambda: dict((k, v) for d in (x, y) for k, v in d.items())))
2.2345519065856934

在python3.5中

>>> min(timeit.repeat(lambda: {**x, **y}))
0.4094954460160807
>>> min(timeit.repeat(lambda: merge_two_dicts(x, y)))
0.7881555100320838
>>> min(timeit.repeat(lambda: {k: v for d in (x, y) for k, v in d.items()} ))
1.4525277839857154
>>> min(timeit.repeat(lambda: dict(itertools.chain(x.items(), y.items()))))
2.3143140770262107
>>> min(timeit.repeat(lambda: dict((k, v) for d in (x, y) for k, v in d.items())))
3.2069112799945287
为什么不来我的博客逛逛了

文章版权归作者所有,未经允许请勿转载,若此文章存在违规行为,您可以联系管理员删除。

转载请注明本文地址:https://www.ucloud.cn/yun/40705.html

相关文章

  • 十三个好用到起飞Python技巧!

    摘要:因其在各个领域的实用性与和等其他编程语言相比的生产力以及与英语类似的命令而广受欢迎。反转字典一个非常常见的字典任务是如果我们有一个字典并且想要反转它的键和值。   ...

    ruicbAndroid 评论0 收藏0
  • 针对Python初学者,这13个好用到起飞小技巧!

    摘要:如果你也是学习爱好者,今天讲述的个小技巧,真挺香欢迎收藏学习,喜欢点赞支持。因此,键将成为值,而值将成为键。幸运的是,这可以通过一行代码快速完成。因此,我们的代码不会因错误而终止。 ...

    张宪坤 评论0 收藏0
  • [零基础学Python]dict()操作方法

    摘要:还有别的方法得到键值吗有一般不是只有一个方法实现某个操作的。删除键值对的方法有两个,但是两者有一点区别,根据删除相应的键值对,并返回该值没有返回值,如果删除键不存在,返回错误用可以把合并到中。 dict的很多方法跟list有类似的地方,下面一一道来,并且会跟list做一个对比 嵌套 嵌套在list中也存在,就是元素是list,在dict中,也有类似的样式: >>> a_list ...

    vpants 评论0 收藏0
  • Python中collections模块使用

    摘要:这里提示一下,有些函数对队列进行操作,但返回值是,比如反转队列,将队列中元素向右移位,尾部的元素移到头部。比如字典中的键映射多个值输出结果如下三用途创建命名字段的元组。四用途统计可哈希的对象。 本文将详细讲解collections模块中的所有类,和每个类中的方法,从源码和性能的角度剖析。 一个模块主要用来干嘛,有哪些类可以使用,看__init__.py就知道 This module i...

    xorpay 评论0 收藏0

发表评论

0条评论

最新活动
阅读需要支付1元查看
<