陈皓专栏 【空谷幽兰,心如皓月】

芝兰生于深谷,不以无人而不芳;君子修道立德,不为困穷而改节。

原创 C++ 虚函数表解析收藏

新一篇: Java NIO类库Selector机制解析(上) | 旧一篇: GPLv3:大教堂和集市的新一轮对抗

C++ 虚函数表解析

 

陈皓

http://blog.csdn.net/haoel

 

 

前言

 

C++中的虚函数的作用主要是实现了多态的机制。关于多态,简而言之就是用父类型别的指针指向其子类的实例,然后通过父类的指针调用实际子类的成员函数。这种技术可以让父类的指针有“多种形态”,这是一种泛型技术。所谓泛型技术,说白了就是试图使用不变的代码来实现可变的算法。比如:模板技术,RTTI技术,虚函数技术,要么是试图做到在编译时决议,要么试图做到运行时决议。

 

 

关于虚函数的使用方法,我在这里不做过多的阐述。大家可以看看相关的C++的书籍。在这篇文章中,我只想从虚函数的实现机制上面为大家 一个清晰的剖析。

 

当然,相同的文章在网上也出现过一些了,但我总感觉这些文章不是很容易阅读,大段大段的代码,没有图片,没有详细的说明,没有比较,没有举一反三。不利于学习和阅读,所以这是我想写下这篇文章的原因。也希望大家多给我提意见。

 

言归正传,让我们一起进入虚函数的世界。

 

 

虚函数表

 

C++ 了解的人都应该知道虚函数(Virtual Function)是通过一张虚函数表(Virtual Table)来实现的。简称为V-Table。在这个表中,主是要一个类的虚函数的地址表,这张表解决了继承、覆盖的问题,保证其容真实反应实际的函数。这样,在有虚函数的类的实例中这个表被分配在了这个实例的内存中,所以,当我们用父类的指针来操作一个子类的时候,这张虚函数表就显得由为重要了,它就像一个地图一样,指明了实际所应该调用的函数。

 

这里我们着重看一下这张虚函数表。在C++的标准规格说明书中说到,编译器必需要保证虚函数表的指针存在于对象实例中最前面的位置(这是为了保证正确取到虚函数的偏移量)。 这意味着我们通过对象实例的地址得到这张虚函数表,然后就可以遍历其中函数指针,并调用相应的函数。

 

听我扯了那么多,我可以感觉出来你现在可能比以前更加晕头转向了。 没关系,下面就是实际的例子,相信聪明的你一看就明白了。

 

假设我们有这样的一个类:

 

class Base {

     public:

            virtual void f() { cout << "Base::f" << endl; }

            virtual void g() { cout << "Base::g" << endl; }

            virtual void h() { cout << "Base::h" << endl; }

 

};

 

按照上面的说法,我们可以通过Base的实例来得到虚函数表。 下面是实际例程:

 

          typedef void(*Fun)(void);

 

            Base b;

 

            Fun pFun = NULL;

 

            cout << "虚函数表地址:" << (int*)(&b) << endl;

            cout << "虚函数表第一个函数地址:" << (int*)*(int*)(&b) << endl;

 

            // Invoke the first virtual function 

            pFun = (Fun)*((int*)*(int*)(&b));

            pFun();

 

实际运行经果如下:(Windows XP+VS2003,  Linux 2.6.22 + GCC 4.1.3)

 

虚函数表地址:0012FED4

虚函数表第一个函数地址:0044F148

Base::f

 

 

通过这个示例,我们可以看到,我们可以通过强行把&b转成int *,取得虚函数表的地址,然后,再次取址就可以得到第一个虚函数的地址了,也就是Base::f(),这在上面的程序中得到了验证(把int* 强制转成了函数指针)。通过这个示例,我们就可以知道如果要调用Base::g()Base::h(),其代码如下:

 

            (Fun)*((int*)*(int*)(&b)+0);  // Base::f()

            (Fun)*((int*)*(int*)(&b)+1);  // Base::g()

            (Fun)*((int*)*(int*)(&b)+2);  // Base::h()

 

这个时候你应该懂了吧。什么?还是有点晕。也是,这样的代码看着太乱了。没问题,让我画个图解释一下。如下所示:

注意:在上面这个图中,我在虚函数表的最后多加了一个结点,这是虚函数表的结束结点,就像字符串的结束符“\0”一样,其标志了虚函数表的结束。这个结束标志的值在不同的编译器下是不同的。在WinXP+VS2003下,这个值是NULL。而在Ubuntu 7.10 + Linux 2.6.22 + GCC 4.1.3下,这个值是如果1,表示还有下一个虚函数表,如果值是0,表示是最后一个虚函数表。

 

 

下面,我将分别说明“无覆盖”和“有覆盖”时的虚函数表的样子。没有覆盖父类的虚函数是毫无意义的。我之所以要讲述没有覆盖的情况,主要目的是为了给一个对比。在比较之下,我们可以更加清楚地知道其内部的具体实现。

 

一般继承(无虚函数覆盖)

 

下面,再让我们来看看继承时的虚函数表是什么样的。假设有如下所示的一个继承关系:

 

 

请注意,在这个继承关系中,子类没有重载任何父类的函数。那么,在派生类的实例中,其虚函数表如下所示:

 

对于实例:Derive d; 的虚函数表如下:

 

我们可以看到下面几点:

1)虚函数按照其声明顺序放于表中。

2)父类的虚函数在子类的虚函数前面。

 

我相信聪明的你一定可以参考前面的那个程序,来编写一段程序来验证。

 

 

 

一般继承(有虚函数覆盖)

 

覆盖父类的虚函数是很显然的事情,不然,虚函数就变得毫无意义。下面,我们来看一下,如果子类中有虚函数重载了父类的虚函数,会是一个什么样子?假设,我们有下面这样的一个继承关系。

 

 

 

为了让大家看到被继承过后的效果,在这个类的设计中,我只覆盖了父类的一个函数:f()。那么,对于派生类的实例,其虚函数表会是下面的一个样子:

 

 

我们从表中可以看到下面几点,

1)覆盖的f()函数被放到了虚表中原来父类虚函数的位置。

2)没有被覆盖的函数依旧。

 

这样,我们就可以看到对于下面这样的程序,

 

            Base *b = new Derive();

 

            b->f();

 

b所指的内存中的虚函数表的f()的位置已经被Derive::f()函数地址所取代,于是在实际调用发生时,是Derive::f()被调用了。这就实现了多态。

 

 

 

多重继承(无虚函数覆盖)

 

下面,再让我们来看看多重继承中的情况,假设有下面这样一个类的继承关系。注意:子类并没有覆盖父类的函数。

 

 

 

对于子类实例中的虚函数表,是下面这个样子:

 

我们可以看到:

1)  每个父类都有自己的虚表。

2)  子类的成员函数被放到了第一个父类的表中。(所谓的第一个父类是按照声明顺序来判断的)

 

这样做就是为了解决不同的父类类型的指针指向同一个子类实例,而能够调用到实际的函数。

 

 

 

 

多重继承(有虚函数覆盖)

 

下面我们再来看看,如果发生虚函数覆盖的情况。

 

下图中,我们在子类中覆盖了父类的f()函数。

 

 

 

下面是对于子类实例中的虚函数表的图:

 

 

我们可以看见,三个父类虚函数表中的f()的位置被替换成了子类的函数指针。这样,我们就可以任一静态类型的父类来指向子类,并调用子类的f()了。如:

 

            Derive d;

            Base1 *b1 = &d;

            Base2 *b2 = &d;

            Base3 *b3 = &d;

            b1->f(); //Derive::f()

            b2->f(); //Derive::f()

            b3->f(); //Derive::f()

 

            b1->g(); //Base1::g()

            b2->g(); //Base2::g()

            b3->g(); //Base3::g()

 

 

安全性

 

每次写C++的文章,总免不了要批判一下C++。这篇文章也不例外。通过上面的讲述,相信我们对虚函数表有一个比较细致的了解了。水可载舟,亦可覆舟。下面,让我们来看看我们可以用虚函数表来干点什么坏事吧。

 

一、通过父类型的指针访问子类自己的虚函数

我们知道,子类没有重载父类的虚函数是一件毫无意义的事情。因为多态也是要基于函数重载的。虽然在上面的图中我们可以看到Base1的虚表中有Derive的虚函数,但我们根本不可能使用下面的语句来调用子类的自有虚函数:

 

          Base1 *b1 = new Derive();

            b1->f1();  //编译出错

 

任何妄图使用父类指针想调用子类中的未覆盖父类的成员函数的行为都会被编译器视为非法,所以,这样的程序根本无法编译通过。但在运行时,我们可以通过指针的方式访问虚函数表来达到违反C++语义的行为。(关于这方面的尝试,通过阅读后面附录的代码,相信你可以做到这一点)

 

 

二、访问non-public的虚函数

另外,如果父类的虚函数是private或是protected的,但这些非public的虚函数同样会存在于虚函数表中,所以,我们同样可以使用访问虚函数表的方式来访问这些non-public的虚函数,这是很容易做到的。

 

如:

 

class Base {

    private:

            virtual void f() { cout << "Base::f" << endl; }

 

};

 

class Derive : public Base{

 

};

 

typedef void(*Fun)(void);

 

void main() {

    Derive d;

    Fun  pFun = (Fun)*((int*)*(int*)(&d)+0);

    pFun();

}

 

 

结束语

C++这门语言是一门Magic的语言,对于程序员来说,我们似乎永远摸不清楚这门语言背着我们在干了什么。需要熟悉这门语言,我们就必需要了解C++里面的那些东西,需要去了解C++中那些危险的东西。不然,这是一种搬起石头砸自己脚的编程语言。

 

在文章束之前还是介绍一下自己吧。我从事软件研发有十个年头了,目前是软件开发技术主管,技术方面,主攻Unix/C/C++,比较喜欢网络上的技术,比如分布式计算,网格计算,P2PAjax等一切和互联网相关的东西。管理方面比较擅长于团队建设,技术趋势分析,项目管理。欢迎大家和我交流,我的MSNEmail是:haoel@hotmail.com 

 

附录一:VC中查看虚函数表

 

我们可以在VCIDE环境中的Debug状态下展开类的实例就可以看到虚函数表了(并不是很完整的)

附录 二:例程

下面是一个关于多重继承的虚函数表访问的例程:

 

#include <iostream>

using namespace std;

 

class Base1 {

public:

            virtual void f() { cout << "Base1::f" << endl; }

            virtual void g() { cout << "Base1::g" << endl; }

            virtual void h() { cout << "Base1::h" << endl; }

 

};

 

class Base2 {

public:

            virtual void f() { cout << "Base2::f" << endl; }

            virtual void g() { cout << "Base2::g" << endl; }

            virtual void h() { cout << "Base2::h" << endl; }

};

 

class Base3 {

public:

            virtual void f() { cout << "Base3::f" << endl; }

            virtual void g() { cout << "Base3::g" << endl; }

            virtual void h() { cout << "Base3::h" << endl; }

};

 

 

class Derive : public Base1, public Base2, public Base3 {

public:

            virtual void f() { cout << "Derive::f" << endl; }

            virtual void g1() { cout << "Derive::g1" << endl; }

};

 

 

typedef void(*Fun)(void);

 

int main()

{

            Fun pFun = NULL;

 

            Derive d;

            int** pVtab = (int**)&d;

 

            //Base1's vtable

            //pFun = (Fun)*((int*)*(int*)((int*)&d+0)+0);

            pFun = (Fun)pVtab[0][0];

            pFun();

 

            //pFun = (Fun)*((int*)*(int*)((int*)&d+0)+1);

            pFun = (Fun)pVtab[0][1];

            pFun();

 

            //pFun = (Fun)*((int*)*(int*)((int*)&d+0)+2);

            pFun = (Fun)pVtab[0][2];

            pFun();

 

            //Derive's vtable

            //pFun = (Fun)*((int*)*(int*)((int*)&d+0)+3);

            pFun = (Fun)pVtab[0][3];

            pFun();

 

            //The tail of the vtable

            pFun = (Fun)pVtab[0][4];

            cout<<pFun<<endl;

 

 

            //Base2's vtable

            //pFun = (Fun)*((int*)*(int*)((int*)&d+1)+0);

            pFun = (Fun)pVtab[1][0];

            pFun();

 

            //pFun = (Fun)*((int*)*(int*)((int*)&d+1)+1);

            pFun = (Fun)pVtab[1][1];

            pFun();

 

            pFun = (Fun)pVtab[1][2];

            pFun();

 

            //The tail of the vtable

            pFun = (Fun)pVtab[1][3];

            cout<<pFun<<endl;

 

 

 

            //Base3's vtable

            //pFun = (Fun)*((int*)*(int*)((int*)&d+1)+0);

            pFun = (Fun)pVtab[2][0];

            pFun();

 

            //pFun = (Fun)*((int*)*(int*)((int*)&d+1)+1);

            pFun = (Fun)pVtab[2][1];

            pFun();

 

            pFun = (Fun)pVtab[2][2];

            pFun();

 

            //The tail of the vtable

            pFun = (Fun)pVtab[2][3];

            cout<<pFun<<endl;

 

            return 0;

}

 

(转载时请注明作者和出处。未经许可,请勿用于商业用途)

 

更多文章请访问我的Blog: http://blog.csdn.net/haoel

 

发表于 @ 2007年12月18日 22:07:00|评论(loading...)|编辑

新一篇: Java NIO类库Selector机制解析(上) | 旧一篇: GPLv3:大教堂和集市的新一轮对抗

评论

#nevergone 发表于2007-12-19 12:11:24  IP: 210.34.129.*
看反汇编代码
最能直接感受什么是虚函数表了
#pmunix 发表于2007-12-19 12:50:44  IP: 116.25.49.*
其实虚表机制还带来一个问题,就是空间的浪费问题
#cxxer 发表于2007-12-19 12:59:31  IP: 210.26.60.*
学习,不错,精彩,感谢.
#doyouwanna 发表于2007-12-19 13:22:24  IP: 61.153.10.*
Driver::f
Driver......
#robotom 发表于2007-12-19 14:09:28  IP: 218.97.242.*
好。
收藏一下。
#lijgame 发表于2007-12-19 15:41:58  IP: 218.83.157.*
似乎vc2005不是以NULL结尾的
如下的代码有问题,能正确获取前面两个虚函数,但是不能正确终止循环:
class CBase
{
public:
virtual void fun1()
{
cout<<"CBase::fun1"<<endl;
}
virtual void fun2()
{
cout<<"CBase::fun2"<<endl;
}
};
typedef void (*fun)();

int GetLengthofVTable()
{
int iLength = 0;
CBase b;
int* pAddr = (int*)*(int*)(&b);
while(*pAddr != NULL)
{
//fun f = (fun)*pAddr;
//f();
cout<<iLength<<endl;
++iLength;
pAddr++;
}
return iLength;
}
2007-12-20 09:37:56作者回复
下面是对你程序的修改<br />int GetLengthofVTable()<br />{<br /> int iLength = 0;<br /> CBase b;<br /> fun* pAddr = (fun*)*(int*)(&amp;b);<br /> while(*pAddr != NULL)<br /> {<br /> (*pAddr)();<br /> cout&lt;&lt;iLength&lt;&lt;endl;<br /> ++iLength;<br /> pAddr++;<br /> }<br /> return iLength;<br />}
#yeyuboy 发表于2007-12-19 15:54:47  IP: 220.168.32.*
好文章。

不过用词不太准确。
重载(overload):函数名相同,参数不同,同一层次下。

在这里应该是覆盖(overwrite)
2007-12-20 09:35:08作者回复
非常感谢,已改正!
#zhy2002 发表于2007-12-19 16:18:21  IP: 221.215.34.*
聪明的读者很喜欢这篇文章。c++既然支持指针有可以随便转换类型,那么那些缺点是必然的,并不是虚函数表特有的缺陷。
#sunhuiyong 发表于2007-12-19 16:52:28  IP: 58.19.119.*
不可否认,是一片好文章。帮助很大。
#newrain021011 发表于2007-12-19 19:50:12  IP: 60.183.206.*
说的很详细,即使对于老手来说,也是一篇不错的文章。
#lishiyong110 发表于2007-12-19 21:36:46  IP: 59.173.130.*
恩 学习一下 通过文章可以认识虚函数深刻些
#hada1234 发表于2007-12-20 09:23:29  IP: 124.78.209.*
好!我顶你!
#haoel 发表于2007-12-20 09:54:27  IP: 10.35.12.*

看来,CSDN的BLOG系统还有些问题,
这里对lijgame所贴的程序回复如下:

下面是对你程序的修改

int GetLengthofVTable()
{
int iLength = 0;
CBase b;
fun* pAddr = (fun*)*(int*)(&b);
while(*pAddr != NULL)
{
(*pAddr)();
cout<<iLength<<endl;
++iLength;
pAddr++;
}
return iLength;
}
#jimmy_w 发表于2007-12-20 11:44:11  IP: 58.212.138.*
挺好的分析,可以扔掉一些书了
#lovekatherine 发表于2007-12-20 13:31:46  IP: 202.113.25.*
"在C++的标准规格说明书中说到,编译器必需要保证虚函数表的指针存在于对象实例中最前面的位置(这是为了保证正确取到虚函数的偏移量)。"

请问能给一下这句话在标准中的出处么?我印象中VPTR的位置是依赖于编译器实现的
#tssing 发表于2007-12-21 11:04:21  IP: 218.85.56.*
太长了,懒得看
#LovelyCboy 发表于2007-12-21 14:42:53  IP: 202.100.89.*
写的很清楚...很好..顶一下...安全都是由于指针引起的,它给我们很大的灵活性.但同时也是错误的根源.C++的访问权限检查只是在编译时进行,而不会在动行时在支看什么有没有访问权限之类的事,如果真那样做的话,我想那也慢的要死...呵呵....最后还是支持这样的好文章以后多出点...
#finlinden 发表于2007-12-24 10:51:03  IP: 210.22.158.*
请允许我问一个弱的问题,因为我还是个C++的半入门者:)
问题如下:请先看我下面引用的作者的文章中的两句,

Base *b = new Derive();

b->f();
由b所指的内存中的虚函数表的f()的位置已经被Derive::f()函数地址所取代,于是在实际调用发生时,是Derive::f()被调用了。这就实现了多态。

【问题是这样的:】
我们为什么要刻意将一个Derive对象的地址付给一个【基类】的指针,来由这个基类指针操作呢?为什么不干脆直接生成一个Derive自己的指针,即:
Derive *b = new Derive();
想引用Derive的方法的话,这样岂不是来得更直接??
——
【问题总结】:
在什么样的需求之下,使得我们:【一定要用:一个base类的指针,来操纵一个Derive类的对象】,才对我们的编程更有利?而用:一个derive类的指针,来直接操纵一个Derive类的对象,则变得索然无味?
2007-12-24 21:45:14作者回复
对于这个问题,我想我还是不要回答的太过明白。还是给你留下一些思考的空间吧。给你一点提示:一个父类可以有多个子类。比如一个shape类可以有circle, rectangle, triangle... 子类,他们都要overwrite父类的纯虚函数draw(),而一个图上有若干个各种图形,在程序中我们用一个shape的指针数组来保存这些不同的图形,于是……, 明白了吗?
#finlinden 发表于2007-12-26 12:25:27  IP: 210.22.158.*
很好,很高的回答
受良师的教益,就像是在读好的宋词一样,在于不把所有东西都点破,而给你自己思想以遐想的空间。~!
——平安夜还在上网?,要多注意休息,多注意享受家庭生活啊:)
#cbk808 发表于2008-01-14 22:54:09  IP: 221.218.141.*
狗屁啊,*(int*)(&b)才是虚函数表的地址
*(int*)*(int*)(&b)才是第一个函数的入口地址
你再用你的猪脑子想想是不是这样
#guogangj 发表于2008-01-28 13:05:43  IP: 61.172.24.*
很好,现在能用心写纯粹意义上的技术文章的人不多了。

对于你所说的对象的内存结构,其实不一定是这样,尤其涉及到多层继承和多重继承同出现的情况,比较复杂,it depends... 编译器不同就有可能不同,另外就是虚函数表并不一定都以int(0)结束,也是it depends...

前阵子我遇到个题目提到private的virtual函数有什么用,你的文章也提到了,但我还是不知道作用,似乎不应该存在这种用法。
#liigo 发表于2008-04-29 09:25:33  IP: 221.201.75.*
C++虚函数表严重依赖编译器
#xzk 发表于2008-04-30 10:42:54  IP: 58.62.113.*
,*(int*)(&b)才是虚函数表的地址
*(int*)*(int*)(&b)才是第一个函数的入口地址
是正解,但是作者的讲解和精神都是可嘉的,小小错漏而已,读者自己还要消化的。
#zieckey 发表于2008-05-05 21:34:31  IP: 125.33.175.*
xzk 发表于2008-04-30 10:42:54 IP: 58.62.113.*
,*(int*)(&b)才是虚函数表的地址
*(int*)*(int*)(&b)才是第一个函数的入口地址
是正解,但是作者的讲解和精神都是可嘉的,小小错漏而已,读者自己还要消化的。

确实是个小小错漏。楼上有兄弟不太客气,不应该阿!
小弟对陈皓先生很是景仰,从《 跟我一起写 Makefile》开始。
下面给出小弟理解后的程序,有错请跟帖。谢谢。

#include <stdio.h>

class Base {
public:
virtual void f() { printf("Base::f()\n"); }
virtual void g() { printf("Base::g()\n"); }
virtual void h() { printf("Base::h()\n"); }
virtual ~Base(){}
};

typedef void(*Fun)();

int main(int argc, char* argv[])
{
Base