最近一直在学习操作系统的知识,今天闲逛在BBS上看到一道题挺有意思:
int main()
{
int x = 5;
if(fork())
{
x += 30;
cout<<x<<endl;
}
else
{
cout<<x<<endl;
}
return 0;
}
问题是输出是什么?
于是查询fork()函数,可知:
头文件:
#include<unistd.h> /* #包含<unistd.h> */
#include<sys/types.h> /* #包含<sys/types.h> */
函数原型:
pid_t fork( void);
(pid_t 是一个宏定义,其实质是int 被定义在#include<sys/types.h>中)
返回值: 若成功调用一次则返回两个值,子进程返回0,父进程返回子进程ID;否则,出错返回-1
函数说明:
一个现有进程可以调用fork函数创建一个新进程。由fork创建的新进程被称为子进程(child process)。fork函数被调用一次但返回两次。两次返回的唯一区别是子进程中返回0值而父进程中返回子进程ID。
子进程是父进程的副本,它将获得父进程数据空间、堆、栈等资源的副本。注意,子进程持有的是上述存储空间的“副本”,这意味着父子进程间不共享这些存储空间。
UNIX将复制父进程的地址空间内容给子进程,因此,子进程有了独立的地址空间。在不同的UNIX (Like)系统下,我们无法确定fork之后是子进程先运行还是父进程先运行,这依赖于系统的实现。所以在移植代码的时候我们不应该对此作出任何的假设。
为什么fork会返回两次?
由于在复制时复制了父进程的堆栈段,所以两个进程都停留在fork函数中,等待返回。因此fork函数会返回两次,一次是在父进程中返回,另一次是在子进程中返回,这两次的返回值是不一样的。过程如下图。
(1)在父进程中,fork返回新创建子进程的进程ID;
(2)在子进程中,fork返回0;
(3)如果出现错误,fork返回一个负值。
在fork函数执行完毕后,如果创建新进程成功,则出现两个进程,一个是子进程,一个是父进程。在子进程中,fork函数返回0,在父进程中,fork返回新创建子进程的进程ID。我们可以通过fork返回的值来判断当前进程是子进程还是父进程。
引用一位网友的话来解释fork函数返回的值为什么在父子进程中不同。“其实就相当于链表,进程形成了链表,父进程的fork函数返回的值指向子进程的进程id, 因为子进程没有子进程,所以其fork函数返回的值为0.
调用fork之后,数据、堆栈有两份,代码仍然为一份但是这个代码段成为两个进程的共享代码段都从fork函数中返回,箭头表示各自的执行处。当父子进程有一个想要修改数据或者堆栈时,两个进程真正分裂。
因此我们可以推断出,最开始的题目有三种可能的输出结果:
(1)输出为5,35:当父进程成功fork出子进程后,父进程返回子进程ID,而子进程返回0.所以父进程进入else段,输出5,而子进程输出为35.通过上述介绍中红色字体部分可知,无法确认父进程先运行还是子进程先运行.所以最终输出可能是(5,35)也可能是(35,5)
(2)父进程fork子进程失败,返回值为一个负数,那么代码直接进入else段,输出5.
所以最终答案为:(5,35)或(35,5)或(5)