Python中Collections模块的Counter容器类使用教程
1、collections模块
collections模块自Python2.4版本开始被引入,包含了dict,set,list,tuple以外的一些特殊容器类型,分别是:
OrderedDict类:
排序字典,是字典的子类。引入自Python2.7
namedtuple()函数:
命名元组,是一个工厂函数。引入自Python2.6
Counter类:
为hashable对象技术,是字典的子类。引入自Python2.7
deque:
双向队列。引入自2.4
defaultdict:
使用工厂函数创建字典,使用不用考虑缺少的字典值
2、Counter类
Counter
类的目的是用来跟踪值出现的次数
它是一个无序的容器类型,以字典的键值对形式存储,其中元素作为key,其出现的次数作为value。计数值可以是任意的interger(包括0和负数)
2.1 创建
下面的代码说明了Counter类创建的四种方法:
from collections import Counter
c = Counter() #创建一个空的Counter类
C = Counter('gallahad') #从一个可迭代对象(list、tuple、dict、字符串等)创建
c = Counter({'a': 4, 'b': 2}) #从一个字典对象创建
c = Counter(a=4, b=2) #从一组键值对创建
2.2、计数值的访问与缺失的键
当所访问的键不存在时,返回0,而不是KeyError;当键存在时返回它存在的次数
eg:
c = Counter("abcdefgab")
print(c["a"]) #2
print(c["c"]) #1
print(c["h"]) #0
2.3、计数器的更新
可以使用一个iterable对象或者另一个Counter对象来更新键值
计数器的更新包括增加和减少两种
2.3.1、计数器的增加更新
计数器的增加更新使用的是update()
方法
c = Counter('which')
print(c['h']) #2
c.update('witch') #使用另一个iterable对象更新
print(c['h']) #3
d = Counter('watch')
print(d['h']) #1
c.update(d) #使用另一个Counter对象更新
print(c['h']) #4
2.3.2、计数器的减少更新
计数器的减少更新使用的是subtract()
方法
c = Counter('which')
print(c['h']) #2
c.subtract('witch') #使用另一个iterable对象更新
print(c['h']) #1
d = Counter('watch')
print(d['h']) #1
c.subtract(d) #使用另一个Counter对象更新
print(c['a']) #-1
2.4、键的删除
当计数值为0时,并不意味着元素被删除,删除元素应当使用del
c = Counter("abcdcba")
print(c)
#Counter({'a': 2, 'c': 2, 'b': 2, 'd': 1})
c["b"] = 0
print(c)
#Counter({'a': 2, 'c': 2, 'd': 1, 'b': 0})
del c["a"]
print(c)
#Counter({'c': 2, 'b': 2, 'd': 1})
2.5、elements()
elements()
可以返回一个迭代器。元素被重复了多少次,在该迭代器中就包含多少个该元素。
所有元素按照字母序排序,个数小于1的元素不被包含
c = Counter(a=4, b=2, c=0, d=-2)
print(list(c.elements()))
#['a', 'a', 'a', 'a', 'b', 'b']
2.6、算术和集合操作
+
、-
、&
、|
操作也可以用于Counter。
其中&
和|
分别返回两个Counter对象各元素的最小值和最大值。需要注意的是,得到的Counter对象将删除小于1的元素
c = Counter(a=3, b=1)
d = Counter(a=1, b=2)
print(c+d) #Counter({'a': 4, 'b':3})
print(c-d) #Counter({'a': 2}),只保留正数计数的元素
print(c&d) #Counter({'a': 1, 'b':1}),保留较小的值
print(c|d) #Counter({'a': 3, 'b':2}),保留较大的值
2.7、常用操作
sum(c.values()) #所有计数的总数
c.clear() #重置Counter对象,注意不是删除
list(c) #将c中的键转为列表
set(c) #将c中的键转为set
dict(c) #将c中的键值对转为字典
c.items() #转为(elem, cnt)格式的列表
c.most_common()[:-n:-1] #取出计数最少的n哥元素
c += Counter() #移除0和负值