fork()函数
Python的os模块封装了常见的系统调用,其中就包括fork,可以在Python程序中轻松创建子进程,但是fork函数,只在Unix/Linux/Mac上运行,windows不可以
例子:
import os
# 注意,fork函数,只在Unix/Linux/Mac上运行,windows不可以
pid = os.fork()
if pid == 0:
print('哈哈1')
else:
print('哈哈2')
-
在Unix/Linux操作系统中,提供了一个fork()系统函数,它非常特殊。 普通的函数调用,调用一次,返回一次,但是fork()调用一次,返回两次,因为操作系统自动把当前进程(称为父进程)复制了一份(称为子进程),然后,分别在父进程和子进程内返回。子进程永远返回0,而父进程返回子进程的ID。
-
这样做的理由是,一个父进程可以fork出很多子进程,所以,父进程要记下每个子进程的ID,而子进程只需要调用getppid()就可以拿到父进程的ID。
getpid()和getppid()
import os
fpid = os.fork()
if fpid < 0:
print("fork函数调用失败!")
elif fpid == 0:
print("我是子进程{},我的父进程是{}".format(os.getpid(),os.getppid()))
else:
print("我是父进程{},我的子进程是{}".format(os.getpid(), fpid))
# 输出结果
我是父进程697,我的子进程是698
我是子进程698,我的父进程是697
multiprocessing模块
fork函数在windows中无法执行,但是multiprocessing模块就是跨平台版本的多进程模块。
- 例子1:启动一个子进程,并等待结束
from multiprocessing import Process
import os
def run(name):
print("我是子进程{},我的pid是:{},我的父进程是{}".format(name,os.getpid(),os.getppid()))
if __name__ == '__main__':
print("我是父进程,我的pid是{}".format(os.getpid()))
P1 = Process(target=run,args=(1,))
P2 = Process(target=run,args=(2,))
P3 = Process(target=run,args=(3,))
P1.start()
P2.start()
P3.start()
P1.join()
P2.join()
P3.join()
print("子进程结束")
输出结果:
我是父进程,我的pid是769
我是子进程1,我的pid是:770,我的父进程是769
我是子进程2,我的pid是:771,我的父进程是769
我是子进程3,我的pid是:772,我的父进程是769
子进程结束
-
Process语法结构如下:
-
Process([group [, target [, name [, args [, kwargs]]]]])
-
target:表示这个进程实例所调用对象;
-
args:表示调用对象的位置参数元组;
-
kwargs:表示调用对象的关键字参数字典;
-
name:为当前进程实例的别名;
-
group:大多数情况下用不到;
-
-
Process类常用方法:
-
is_alive():判断进程实例是否还在执行;
-
join([timeout]):是否等待进程实例执行结束,或等待多少秒;
-
start():启动进程实例(创建子进程);
-
run():如果没有给定target参数,对这个对象调用start()方法时,就将执行对象中的run()方法;
-
terminate():不管任务是否完成,立即终止;
-
-
Process类常用属性:
-
name:当前进程实例别名,默认为Process-N,N为从1开始递增的整数;
-
pid:当前进程实例的PID值;
-
- 例子2
#coding=utf-8
from multiprocessing import Process
import time
import os
#两个子进程将会调用的两个方法
def worker_1(interval):
print("worker_1,父进程(%s),当前进程(%s)"%(os.getppid(),os.getpid()))
t_start = time.time()
time.sleep(interval) #程序将会被挂起interval秒
t_end = time.time()
print("worker_1,执行时间为'%0.2f'秒"%(t_end - t_start))
def worker_2(interval):
print("worker_2,父进程(%s),当前进程(%s)"%(os.getppid(),os.getpid()))
t_start = time.time()
time.sleep(interval)
t_end = time.time()
print("worker_2,执行时间为'%0.2f'秒"%(t_end - t_start))
#输出当前程序的ID
print("进程ID:%s"%os.getpid())
#创建两个进程对象,target指向这个进程对象要执行的对象名称,
#args后面的元组中,是要传递给worker_1方法的参数,
#因为worker_1方法就一个interval参数,这里传递一个整数2给它,
#如果不指定name参数,默认的进程对象名称为Process-N,N为一个递增的整数
p1=Process(target=worker_1,args=(2,))
p2=Process(target=worker_2,name="dongGe",args=(1,))
#使用"进程对象名称.start()"来创建并执行一个子进程,
#这两个进程对象在start后,就会分别去执行worker_1和worker_2方法中的内容
p1.start()
p2.start()
#同时父进程仍然往下执行,如果p2进程还在执行,将会返回True
print("p2.is_alive=%s"%p2.is_alive())
#输出p1和p2进程的别名和pid
print("p1.name=%s"%p1.name)
print("p1.pid=%s"%p1.pid)
print("p2.name=%s"%p2.name)
print("p2.pid=%s"%p2.pid)
#join括号中不携带参数,表示父进程在这个位置要等待p1进程执行完成后,
#再继续执行下面的语句,一般用于进程间的数据同步,如果不写这一句,
#下面的is_alive判断将会是True,在shell(cmd)里面调用这个程序时
#可以完整的看到这个过程,大家可以尝试着将下面的这条语句改成p1.join(1),
#因为p2需要2秒以上才可能执行完成,父进程等待1秒很可能不能让p1完全执行完成,
#所以下面的print会输出True,即p1仍然在执行
p1.join()
print("p1.is_alive=%s"%p1.is_alive())
#执行结果:
进程ID:19866
p2.is_alive=True
p1.name=Process-1
p1.pid=19867
p2.name=dongGe
p2.pid=19868
worker_1,父进程(19866),当前进程(19867)
worker_2,父进程(19866),当前进程(19868)
worker_2,执行时间为'1.00'秒
worker_1,执行时间为'2.00'秒
p1.is_alive=False
-
Lock组件
-
当我们用多进程来读写文件的时候,如果一个进程是写文件,一个进程是读文件,如果两个文件同时进行,肯定是不行的,必须是文件写结束以后,才可以进行读操作。或者是多个进程在共享一些资源的时候,同时只能有一个进程进行访问,那就要有一个锁机制进行控制。
-
需求:
- 一个进程写入一个文件,一个进程追加文件,一个进程读文件,同时启动起来,我们可以通过进程的join()方法来实现,但是为了学习Lock,用Lock来实现。
先看不加锁程序,在看加锁程序,最后比较两个程序的区别
- 例子1
def lock_with(lock,f): with lock: fs = open(f,'w') fs.write('Lock acquired via with' + '\n') fs.close() def lock_acquire(lock,f): lock.acquire() try: fs = open(f,'a') fs.write('lock acquired via acquire' + '\n') fs.close() finally: lock.release() if __name__ == '__main__': f = 'test.txt' lock = multiprocessing.Lock() pw = multiprocessing.Process(target=lock_with,args=(lock,f)) pa = multiprocessing.Process(target=lock_acquire,args=(lock,f)) pw.start() pa.start() pw.join() pa.join()
- 例子2
def add1(lock,val,num): with lock: print("The initial number is {}".format(num)) for i in range(1,5): num += val time.sleep(0.3) print("The number is {}".format(num)) def add3(lock,val,num): lock.acquire() print("The initial number is {}".format(num)) try: for i in range(1,5): num += val time.sleep(0.3) print("The number is {}".format(num)) finally: lock.release() if __name__ == '__main__': lock = multiprocessing.Lock() p1 = multiprocessing.Process(target=add1,args=(lock,1,0)) p3 = multiprocessing.Process(target=add1,args=(lock,3,0)) p1.start() p3.start() print("Main process end!")
输出结果:
Main process end! The initial number is 0 # add1抢到优先权,率先执行 The number is 1 The number is 2 The number is 3 The number is 4 The initial number is 0 # add3被阻塞,等add1执行完后在执行add3 The number is 3 The number is 6 The number is 9 The number is 12
-