先说列表生成式,例如:
a=[i*2 for i in range(5)]
print>>[0, 2, 4, 6, 8]
使用这个方式,可以简写代码。
通过列表生成式,我们可以直接创建一个列表。但是,受到内存限制,列表容量肯定是有限的。而且,创建一个包含100万个元素的列表,不仅占用很大的存储空间,如果我们仅仅需要访问前面几个元素,那后面绝大多数元素占用的空间都白白浪费了。
所以,如果列表元素可以按照某种算法推算出来,那我们是否可以在循环的过程中不断推算出后续的元素呢?这样就不必创建完整的list,从而节省大量的空间。在Python中,这种一边循环一边计算的机制,称为生成器:generator。
要创建一个generator,有很多种方法。第一种方法很简单,只要把一个列表生成式的[]
改成()
,就创建了一个generator:
>>> L = [x * x for x in range(10)] >>> L#这里是一个列表 [0, 1, 4, 9, 16, 25, 36, 49, 64, 81] >>> g = (x * x for x in range(10)) >>> g#这里是一个生成器 <generator object <genexpr> at 0x1022ef630>
创建L
和g
的区别仅在于最外层的[]
和()
,L
是一个list,而g
是一个generator。
我们可以直接打印出list的每一个元素,但我们怎么打印出generator的每一个元素呢?
如果要一个一个打印出来,可以通过next()
函数获得generator的下一个返回值:
>>>
next
(g)
0
>>>
next
(g)
1
>>>
next
(g)
4
。。。
>>>
next
(g)
81
>>>
next
(g)
Traceback (most recent call last):
File
"<stdin>"
, line
1
,
in
<module>
StopIteration
我们讲过,generator保存的是算法,每次调用
next(g)
,就计算出
g
的下一个元素的值,直到计算到最后一个元素,没有更多的元素时,抛出
StopIteration
的错误。
这是很麻烦的用法,基本不用,最简单的方式,generator也可以迭代,所以:
for i in g:
print i
就轻松解决了!
第二种方法:如果一个函数定义中包含
yield
关键字,那么这个函数就不再是一个普通函数,而是一个generator。
def fib(max):#这是一个输出斐波拉奇数列的函数。 n,a,b = 0,0,1 while n < max: #print(b) yield b a,b = b,a+b n += 1 return 'done'
这里,最难理解的就是generator和函数的执行流程不一样。函数是顺序执行,遇到return
语句或者最后一行函数语句就返回。
而变成generator的函数,在每次调用next()
的时候执行,遇到yield
语句返回,再次执行时从上次返回的yield
语句处继续执行。
但是用for
循环调用generator时,发现拿不到generator的return
语句的返回值。如果想要拿到返回值,必须捕获StopIteration
错误,
返回值包含在StopIteration
的value
中:
>>> g = fib(6) >>> while True: ... try: ... x = next(g) ... print('g:', x) ... except StopIteration as e: ... print('Generator return value:', e.value) ... break
还可通过yield实现在单线程的情况下实现并发运算的效果
#_*_coding:utf-8_*_ __author__ = 'Alex Li' import time def consumer(name): print("%s 准备吃包子啦!" %name) while True: baozi = yield print("包子[%s]来了,被[%s]吃了!" %(baozi,name)) def producer(name): c = consumer('A') c2 = consumer('B') c.__next__() c2.__next__() print("老子开始准备做包子啦!") for i in range(10): time.sleep(1) print("做了2个包子!") c.send(i)#send传值,next不传 c2.send(i) producer("alex") 通过生成器实现协程并行运算