Python中Collections模块的Counter容器类使用教程

Python中Collections模块的Counter容器类使用教程

1、collections模块

collections模块自Python2.4版本开始被引入,包含了dict,set,list,tuple以外的一些特殊容器类型,分别是:
OrderedDict类:排序字典,是字典的子类。引入自Python2.7
namedtuple()函数:命名元组,是一个工厂函数。引入自Python2.6
Counter类:为hashable对象技术,是字典的子类。引入自Python2.7
deque:双向队列。引入自2.4
defaultdict:使用工厂函数创建字典,使用不用考虑缺少的字典值

2、Counter类

Counter类的目的是用来跟踪值出现的次数
它是一个无序的容器类型,以字典的键值对形式存储,其中元素作为key,其出现的次数作为value。计数值可以是任意的interger(包括0和负数)

2.1 创建

下面的代码说明了Counter类创建的四种方法:

from collections import Counter

c = Counter() #创建一个空的Counter类
C = Counter('gallahad') #从一个可迭代对象(list、tuple、dict、字符串等)创建
c = Counter({'a': 4, 'b': 2}) #从一个字典对象创建
c = Counter(a=4, b=2) #从一组键值对创建

2.2、计数值的访问与缺失的键

当所访问的键不存在时,返回0,而不是KeyError;当键存在时返回它存在的次数

eg:

c = Counter("abcdefgab")
print(c["a"]) #2
print(c["c"]) #1
print(c["h"]) #0

2.3、计数器的更新

可以使用一个iterable对象或者另一个Counter对象来更新键值
计数器的更新包括增加和减少两种

2.3.1、计数器的增加更新

计数器的增加更新使用的是update()方法

c = Counter('which')
print(c['h']) #2
c.update('witch') #使用另一个iterable对象更新
print(c['h']) #3

d = Counter('watch')
print(d['h']) #1
c.update(d) #使用另一个Counter对象更新
print(c['h']) #4
2.3.2、计数器的减少更新

计数器的减少更新使用的是subtract()方法

c = Counter('which')
print(c['h']) #2
c.subtract('witch') #使用另一个iterable对象更新
print(c['h']) #1

d = Counter('watch')
print(d['h']) #1
c.subtract(d) #使用另一个Counter对象更新
print(c['a']) #-1

2.4、键的删除

当计数值为0时,并不意味着元素被删除,删除元素应当使用del

c = Counter("abcdcba")
print(c)
#Counter({'a': 2, 'c': 2, 'b': 2, 'd': 1})

c["b"] = 0
print(c)
#Counter({'a': 2, 'c': 2, 'd': 1, 'b': 0})

del c["a"]
print(c)
#Counter({'c': 2, 'b': 2, 'd': 1})

2.5、elements()

elements()可以返回一个迭代器。元素被重复了多少次,在该迭代器中就包含多少个该元素。
所有元素按照字母序排序,个数小于1的元素不被包含

c = Counter(a=4, b=2, c=0, d=-2)
print(list(c.elements()))
#['a', 'a', 'a', 'a', 'b', 'b']

2.6、算术和集合操作

+-&|操作也可以用于Counter。

其中&|分别返回两个Counter对象各元素的最小值和最大值。需要注意的是,得到的Counter对象将删除小于1的元素

c = Counter(a=3, b=1)
d = Counter(a=1, b=2)
print(c+d) #Counter({'a': 4, 'b':3})
print(c-d) #Counter({'a': 2}),只保留正数计数的元素
print(c&d) #Counter({'a': 1, 'b':1}),保留较小的值
print(c|d) #Counter({'a': 3, 'b':2}),保留较大的值

2.7、常用操作

sum(c.values()) #所有计数的总数
c.clear() #重置Counter对象,注意不是删除
list(c) #将c中的键转为列表
set(c) #将c中的键转为set
dict(c) #将c中的键值对转为字典
c.items() #转为(elem, cnt)格式的列表
c.most_common()[:-n:-1] #取出计数最少的n哥元素
c += Counter() #移除0和负值
  • 0
    点赞
  • 1
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
### 回答1: collections模块Python标准库的一个模块,提供了许多有用的数据型。其包括: - deque: 双端队列 - Counter: 计数器 - OrderedDict: 有序字典 - defaultdict: 默认字典 - namedtuple: 命名元组 - ChainMap: 链接多个字典 使用这些型可以更方便地进行数据操作和处理。 ### 回答2: collectionsPython标准库的一个模块,提供了许多有用的容器数据型。这些数据型是基于内置的数据型(如字典,列表和集合等)的实现,以提供更多的功能和灵活性。 collections模块最常用的数据型是:Counter、defaultdict、OrderedDict和namedtuple。 Counter是一个字典的子,用于计算可哈希对象的出现次数。它可以接受任何可哈希对象的序列作为输入,并返回一个字典,其包含每个对象作为键和其出现次数作为值。 defaultdict是一个字典的子,它可以接受一个工厂函数作为参数。当访问不存在的键时,默认会返回该工厂函数的返回值,而不是抛出KeyError异常。这对于处理缺失键的情况非常有用。 OrderedDict是一个有序的字典,它以插入顺序来维护元素的顺序。与普通的字典不同,OrderedDict可以记住元素的添加顺序,从而实现按照插入顺序进行遍历。 namedtuple是一个工厂函数,用于创建具有命名字段的元组子。它允许我们为元组的每个字段指定一个名称,从而增加了元组的可读性和代码的可维护性。 除了上述常用的数据型外,collections模块还提供了其他一些有用的,如deque(双端队列)、ChainMap(合并多个字典)、UserDict(方便地创建字典的一种方式)等。 总而言之,collections模块扩展了Python内置的容器数据型,提供了更多方便、灵活和高效的数据结构,使我们在处理数据时更加方便和高效。它是每个Python程序员都应该熟悉和掌握的重要模块之一。 ### 回答3: collections模块Python标准库的一个模块,提供了一些常用的数据型和工具,用于扩展内置的数据型,提供方便的数据结构和算法。 collections模块最常用的数据型是容器型,包括:Counter、defaultdict、deque、OrderedDict和namedtuple。 1. Counter:用于计数元素出现的次数,并以字典的形式返回计数结果。它可以用于快速计数列表、字符串或任何可迭代对象的元素。 2. defaultdict:是内置字典(dict)的一个子,它通过传入一个默认值工厂函数,当键不存在时返回该默认值。这对于需要设置默认值的字典非常有用。 3. deque:双端队列,可以快速在两端进行插入和删除操作,比内置的list型更高效。 4. OrderedDict:有序字典,它会根据元素的插入顺序保持顺序,与普通字典不同,遍历时返回的键值对按照插入顺序排列。 5. namedtuple:命名元组,是一个生成的工厂函数,用于创建具有字段名称的元组。它可以通过字段名称访问元组的元素,提高了程序的可读性。 除了这些常用的数据型,collections模块还提供了一些其他的工具函数,用于处理迭代器、排序和计数等操作。 总之,collections模块Python开发者提供了一些有用的数据型和工具,可以简化常见的数据操作,提高开发效率。无论是在处理复杂数据结构还是简单计数,使用collections模块可以更方便地进行操作和处理。
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值