Python中的collections模块(四) UserString,UserList,和UserDict

前言

Python 内置模块collections, 目标是提供各种专门的集合数据类型来解决特定的编程问题。

本系列介绍其中的数据结构特点和使用方法,  以便遇到某些特定的问题,可以找到对应的数据来处理, 达到事半功倍的效果

其他的可以参考

Python中的collections模块(一) 使用Counter,pythonic的对象计数方式

Python中的collections模块(二) 有序字典OrderedDict和链接字典ChainMap

Python中的collections模块(三) 命名元组namedtuple和双端队列deque

为什么要使用UserString,UserList,UserDict

编码中有时你需要自定义内置类型,例如字符串、列表和字典,以添加和修改某些行为。大部分时候可以直接对这些类型进行子类化来实现。

但是有的时候会发现, 子类化的实例并不像预期中那样表现, 因为Python对内置类型的设计和实现考虑到了开闭原则(对扩展开放,但对修改关闭)。

例如, 我需要创建一个在插入键时自动将键转为小写的字典。

可以通过子类化dict并覆盖.__setitem__()函数, 每次插入键时将键名转为小写:

In [1]: class LowerDict(dict):
   ...:     def __setitem__(self, key, value):
   ...:         key = key.lower()
   ...:         super().__setitem__(key, value)

In [2]: data = LowerDict({'FIRST': 1, 'SECOND': 2})
In [3]: data['THIRD'] = 3
In [4]: data.update({'FOURTH': 4})

In [5]: data
Out[5]: {'FIRST': 1, 'SECOND': 2, 'third': 3, 'FOURTH': 4}

可以看到,只有使用 [ ]   为字典赋值时的THIRD被转成了小写, 而调用update和初始化函数时, 转小写并没有生效。必须要覆盖这两个方法才可以

In [6]: class LowerDict(dict):
   ...:     def __init__(self, data):
   ...:         data = {k.lower(): v for k, v in data.items()}
   ...:         super().__init__(data)

   ...:     def __setitem__(self, key, value):
   ...:         key = key.lower()
   ...:         super().__setitem__(key, value)

   ...:     def update(self, data):
   ...:         data = {k.lower(): v for k, v in data.items()}
   ...:         super().update(data)

使用UserDict

使用UserDict作为父类来实现上述功能。

In [16]: class LowerDict(UserDict):
    ...:     def __setitem__(self, key, value):
    ...:         key = key.lower()
    ...:         super().__setitem__(key, value)
    ...:

In [17]: data = LowerDict({"FIRST": 1, "SECOND": 2})
In [18]: data["THIRD"] = 3
In [19]: data.update({'FOURTH': 4})

In [20]: data
Out[20]: {'first': 1, 'second': 2, 'third': 3, 'fourth': 4}

结论:

当需要对内置数据类型进行拓展, 并且想要覆写其某些标准功能能时,应该使用UserDictUserList, 和UserString,而不是直接继承dict,list, str.

  • 4
    点赞
  • 1
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
### 回答1: collections模块Python标准库的一个模块,提供了许多有用的数据类型。其包括: - deque: 双端队列 - Counter: 计数器 - OrderedDict: 有序字典 - defaultdict: 默认字典 - namedtuple: 命名元组 - ChainMap: 链接多个字典 使用这些类型可以更方便地进行数据操作和处理。 ### 回答2: collectionsPython标准库的一个模块,提供了许多有用的容器数据类型。这些数据类型是基于内置的数据类型(如字典,列表和集合等)的实现,以提供更多的功能和灵活性。 collections模块最常用的数据类型是:Counter、defaultdict、OrderedDict和namedtuple。 Counter是一个字典的子类,用于计算可哈希对象的出现次数。它可以接受任何可哈希对象的序列作为输入,并返回一个字典,其包含每个对象作为键和其出现次数作为值。 defaultdict是一个字典的子类,它可以接受一个工厂函数作为参数。当访问不存在的键时,默认会返回该工厂函数的返回值,而不是抛出KeyError异常。这对于处理缺失键的情况非常有用。 OrderedDict是一个有序的字典,它以插入顺序来维护元素的顺序。与普通的字典不同,OrderedDict可以记住元素的添加顺序,从而实现按照插入顺序进行遍历。 namedtuple是一个工厂函数,用于创建具有命名字段的元组子类。它允许我们为元组的每个字段指定一个名称,从而增加了元组的可读性和代码的可维护性。 除了上述常用的数据类型外,collections模块还提供了其他一些有用的类,如deque(双端队列)、ChainMap(合并多个字典)、UserDict(方便地创建字典的一种方式)等。 总而言之,collections模块扩展了Python内置的容器数据类型,提供了更多方便、灵活和高效的数据结构,使我们在处理数据时更加方便和高效。它是每个Python程序员都应该熟悉和掌握的重要模块之一。 ### 回答3: collections模块Python标准库的一个模块,提供了一些常用的数据类型和工具,用于扩展内置的数据类型,提供方便的数据结构和算法。 collections模块最常用的数据类型是容器类型,包括:Counter、defaultdict、deque、OrderedDict和namedtuple。 1. Counter:用于计数元素出现的次数,并以字典的形式返回计数结果。它可以用于快速计数列表、字符串或任何可迭代对象的元素。 2. defaultdict:是内置字典类(dict)的一个子类,它通过传入一个默认值工厂函数,当键不存在时返回该默认值。这对于需要设置默认值的字典非常有用。 3. deque:双端队列,可以快速在两端进行插入和删除操作,比内置的list类型更高效。 4. OrderedDict:有序字典,它会根据元素的插入顺序保持顺序,与普通字典不同,遍历时返回的键值对按照插入顺序排列。 5. namedtuple:命名元组,是一个生成类的工厂函数,用于创建具有字段名称的元组。它可以通过字段名称访问元组的元素,提高了程序的可读性。 除了这些常用的数据类型,collections模块还提供了一些其他的工具函数,用于处理迭代器、排序和计数等操作。 总之,collections模块Python开发者提供了一些有用的数据类型和工具,可以简化常见的数据操作,提高开发效率。无论是在处理复杂数据结构还是简单计数,使用collections模块可以更方便地进行操作和处理。

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值