作者 | dog250
责编 | 屠敏
头图 | CSDN 下载自东方 IC
出品 | CSDN 博客
C 语言中,未初始化的局部变量到底是多少?
答案往往是:
与编译器有关。
可能但不保证初始化为 0。
未确定。
总之,全部都是些一本正经的形而上答案,这很令人讨厌。
但凡一些人给你滔滔不绝地扯编译器,C 库,处理器体系结构却给不出一个实际场景复现问题的时候,这人大概率在扯淡。
其实,这个问题本身就是错误的问法,说全了能讲 10 万字,我们只要能在特定场景下确定其特定行为就 OK 了,当然,这就需要设计一个比较 OK 的实验。
在演示一个实际代码行为之前,先给出一个知识, CPU 不认识变量,更无法识别变量的名字,CPU 只会从特定的内存位置取值或者将值存到特定的内存位置,因此当问一个变量的值是多少的时候,必须要知道这个变量对应的值被保存在什么地方。
来看下面的代码:
#include
void func1 ( ) { int a; printf ( "func1:%dn", a ) ; a = 12345;}
void func2 ( ) { int b; printf ( "func2:%dn", b ) ;}
void func4 ( ) { int d; printf ( "func3:%dn", d ) ;}
void func3 ( ) { int c; printf ( "func3:%dn", c ) ; c = 54321; func4 ( ) ;}
void test_call ( ) { func3 ( ) ;}
int main ( int argc, char **argv ) { func1 ( ) ; func2 ( ) ;
test_call ( ) ;}
我们有 func1~func4 一共 4 个函数,其内部均有一个未初始化的局部变量,它们的值到底是多少呢?
对于这种局部变量,它们的值取决于:
变量在栈中的位置。
变量对应的栈位置在 之前 有没有被 store 过。
可以看到,上述第一点标记了一个内存位置,第二点则是代码的行为,也就是说,只要有代码去 store 对应的位置, 且后续的代码没有 reset 该位置的值的话,该位置就会保留着原先被 store 后的值。
验证非常简单,试一下就知道了:
[ root@localhost test ] # ./a.outfunc1:0func2:12345func3:0func3:0
按照函数调用栈帧的变化,func1 的局部变量 a 和 func2 的局部变量 b 显然是位于同一个位置的,在 func1 被调用时,这是一块新的内存 ( 可能在进入 main 之前有栈帧到达过这个位置 ) ,a 的值取决于调入内存该位置的页面对应偏移的初始值,这取决于操作系统:
操作系统在分配给程序页面时可能会将页面 clear 为零页。
栈的分配不会涉及 C 库,这里显然并不涉及 C 库的行为,但类似 malloc 分配的内存则涉及 C 库了。
打印结果,a 的值为 0,我们认为操作系统返回给了应用程序零页。接下来在 func1 中将其赋值 12345 之后函数返回,接下来调用 func2 的时候,在之前 func1 已经退出的栈帧位置重建栈帧,对应位置依然还是 12345。
我没有看到 func1 的 ret 操作后面有 stack 清 0 的代码指令。效率考虑,也不该有这样的指令。
再看 test_call 函数,很明显,func3 和 func4 调用使用的并不是同一个栈帧,因此即便是在 func3 中对 c 赋值了 54321,也不会影响在其栈帧之上的 func4 的栈帧对应位置的值 d。因此 c 和 d 的初始值均保持为 0。
那么,初始化一个局部变量和不初始化一个局部变量,在指令层面上,区别在哪里呢?
很简单,亲眼看一下就知道,先看未初始化局部变量的 func1:
// int a;00000000004005ad : 4005ad: 55 push %rbp 4005ae: 48 89 e5 mov %rsp,%rbp 4005b1: 48 83 ec 10 sub $0x10,%rsp 4005b5: 8b 45 fc mov -0x4 ( %rbp ) ,%eax 4005b8: 89 c6 mov %eax,%esi 4005ba: bf 90 07 40 00 mov $0x400790,%edi 4005bf: b8 00 00 00 00 mov $0x0,%eax 4005c4: e8 b7 fe ff ff callq 400480 4005c9: c7 45 fc 39 30 00 00 movl $0x3039,-0x4 ( %rbp ) 4005d0: c9 leaveq 4005d1: c3 retq
再看初始化局部变量 a 为 2222 的版本:
// int a = 2222;00000000004005ad : 4005ad: 55 push %rbp 4005ae: 48 89 e5 mov %rsp,%rbp 4005b1: 48 83 ec 10 sub $0x10,%rsp 4005b5: c7 45 fc 00 00 00 00 movl $0x0,-0x4 ( %rbp ) 4005bc: 8b 45 fc mov -0x4 ( %rbp ) ,%eax 4005bf: 89 c6 mov %eax,%esi 4005c1: bf 90 07 40 00 mov $0x400790,%edi 4005c6: b8 00 00 00 00 mov $0x0,%eax 4005cb: e8 b0 fe ff ff callq 400480 4005d0: c7 45 fc 39 30 00 00 movl $0x3039,-0x4 ( %rbp ) 4005d7: c9 leaveq 4005d8: c3 retq
仅仅差了一条指令:
4005b5: c7 45 fc 00 00 00 00 movl $0x0,-0x4 ( %rbp )
初始化的操作是依靠实实在在的指令完成的。
总结一句,函数返回在 pop 出当前栈帧的时候,并不会清理它遗留在栈帧里的数据,下个函数调用再次重用到该栈帧的内存时,未初始化的局部变量将会被遗留数据影响,从而变得不确定!
所以,记得初始化你的局部变量。
声明:本文为 CSDN 博主「dog250」的原创文章,版权归作者所有。
原文:https://blog.csdn.net/dog250/article/details/107403337
更多精彩推荐
点分享
点点赞
点在看