虚函数表与虚表指针

虚函数表

对C++了解的人都应该知道虚函数(Virtual Function)是通过一张虚函数表(Virtual Table)来实现的。简称为V-Table。在这个表中,主是要一个类的虚函数的地址表,这张表了继承、重载的问题,保证其容真实反应实际的函数。这样,在有虚函数的类的实例中这个表被分配在了这个实例的内存中,所以,当我们用父类的指针来操作一个子类的时候,这张虚函数表就显得由为重要了,它就像一个地图一样,指明了实际所应该调用的函数。

这里我们着重看一下这张虚函数表。在C++的标准规格说明书中说到,编译器必需要保证虚函数表的指针存在于对象实例中最前面的位置(这是为了保证正确取到虚函数的偏移量)。 这意味着我们通过对象实例的地址得到这张虚函数表,然后就可以遍历其中函数指针,并调用相应的函数。

听我扯了那么多,我可以感觉出来你现在可能比以前更加晕头转向了。 没关系,下面就是实际的例子,相信聪明的你一看就明白了。

假设我们有这样的一个类:

class Base { 
public: 
    virtual void f() { 
        cout << "Base::f" << endl; 
    } 
    virtual void g() { 
        cout << "Base::g" << endl; 
    } 
    virtual void h() { 
        cout << "Base::h" << endl; 
    } 
};

按照上面的说法,我们可以通过Base的实例来得到虚函数表。下面是实际例程:

typedef void(*Fun)(void); 
Base b; 
Fun pFun = NULL; 
cout << "虚函数表地址:" << (int*)(&b) << endl; 
cout << "虚函数表 — 第一个函数地址:" << (int*)*(int*)(&b) << endl; 
// Invoke the first virtual function 
pFun = (Fun)*((int*)*(int*)(&b)); 
pFun();

实际运行经果如下:(Windows XP+VS2003, Linux 2.6.22 + GCC 4.1.3)

虚函数表地址:0012FED4
虚函数表 — 第一个函数地址:0044F148Base::f

通过这个示例,我们可以看到,我们可以通过强行把&b转成int *,取得虚函数表的地址,然后,再次取址就可以得到第一个虚函数的地址了,也就是Base::f(),这在上面的中得到了验证(把int* 强制转成了函数指针)。通过这个示例,我们就可以知道如果要调用Base::g()和Base::h(),其代码如下:

(Fun)*((int*)*(int*)(&b)+0); // Base::f()
(Fun)*((int*)*(int*)(&b)+1); // Base::g()
(Fun)*((int*)*(int*)(&b)+2); // Base::h()

这个时候你应该懂了吧!什么?还是有点晕。也是,这样的代码看着太乱了。没问题,让我画个图解释一下。如下所示:

图 1

注意:在上面这个图中,我在虚函数表的最后多加了一个结点,这是虚函数表的结束结点,就像字符串的结束符“\0”一样,其标志了虚函数表的结束。这个结束标志的值在不同的编译器下是不同的。在WinXP+VS2003下,这个值是NULL。而在Ubuntu 7.10 + Linux 2.6.22 + GCC 4.1.3下,这个值是如果1,表示还有下一个虚函数表,如果值是0,表示是最后一个虚函数表。

下面,我将分别说明“无重载”和“有重载”时的虚函数表的样子。没有重载父类的虚函数是毫无意义的。我之所以要讲述没有重载的情况,主要目的是为了给一个对比。在比较之下,我们可以更加清楚地知道其内部的具体实现。

一般继承(无虚函数重载)

下面,再让我们来看看继承时的虚函数表是什么样的。假设有如下所示的一个继承关系:

图 2

请注意,在这个继承关系中,子类没有重载任何父类的函数。那么,在派生类的实例中,其虚函数表如下所示:

对于实例:Derive d; 的虚函数表如下:

图 3

我们可以看到下面几点:

1)虚函数按照其声明顺序放于表中。
2)父类的虚函数在子类的虚函数前面。

我相信聪明的你一定可以参考前面的那个,来编写一段程序来验证。

一般继承(有虚函数重载)

重载父类的虚函数是很显然的事情,不然,虚函数就变得毫无意义。下面,我们来看一下,如果子类中有虚函数重载了父类的虚函数,会是一个什么样子?假设,我们有下面这样的一个继承关系。

图 4

为了让大家看到被继承过后的,在这个类的设计中,我只重载了父类的一个函数:f()。那么,对于派生类的实例,其虚函数表会是下面的一个样子:

图 5

我们从表中可以看到下面几点,

1)重载的f()函数被放到了虚表中原来父类虚函数的位置。
2)没有被重载的函数依旧。

这样,我们就可以看到对于下面这样的程序,

Base *b = new Derive();
b->f();

由b所指的内存中的虚函数表的f()的位置已经被Derive::f()函数地址所取代,于是在实际调用发生时,是Derive::f()被调用了。这就实现了多态。

多重继承(无虚函数重载)

下面,再让我们来看看多重继承中的情况,假设有下面这样一个类的继承关系。注意:子类并没有重载复类的函数。

图 6

对于子类实例中的虚函数表,是下面这个样子:

图 7

我们可以看到:

1)每个父类都有自己的虚表。
2)子类的成员函数被放到了第一个父类的表中。(所谓的第一个父类是按照声明顺序来判断的)

这样做就是为了不同的父类类型的指针指向同一个子类实例,而能够调用到实际的函数。

多重继承(有虚函数重载)

下面我们再来看看,如果发生虚函数重载的情况。

下图中,我们重载了父类的f()函数。

图 8

下面是对于子类实例中的虚函数表的图:

图 9

我们可以看见,三个父类虚函数表中的f()的位置被替换成了子类的函数指针。这样,我们就可以任一静态类型的父类来指向子类,并调用子类的f()了。如:

Derive d;
Base1 *b1 = &d;
Base2 *b2 = &d;
Base3 *b3 = &d;
b1->f(); //Derive::f()
b2->f(); //Derive::f()
b3->f(); //Derive::f()
b1->g(); //Base1::g()
b2->g(); //Base2::g()
b3->g(); //Base3::g()

安全性

每次写C++的文章,总免不了要批判一下C++。这篇文章也不例外。通过上面的讲述,相信我们对虚函数表有一个比较细致的了解了。水可载舟,亦可覆舟。下面,让我们来看看我们可以用虚函数表来干点什么坏事吧。

1、通过父类型的指针访问子类自己的虚函数

我们知道,子类没有重载父类的虚函数是一件毫无意义的事情。因为多态也是要基于函数重载的。虽然在上面的图中我们可以看到Base1的虚表中有Derive的虚函数,但我们根本不可能使用下面的语句来调用子类的自有虚函数:

Base1 *b1 = new Derive();
b1->f1(); //编译出错

任何妄图使用父类指针想调用子类中的未重载父类的成员函数的行为都会被编译器视为非法,所以,这样的根本无法编译通过。但在运行时,我们可以通过指针的方式访问虚函数表来达到违反C++语义的行为。(关于这方面的尝试,通过阅读后面附录的代码,相信你可以做到这一点)

2、访问non-public的虚函数

另外,如果父类的虚函数是private或是protected的,但这些非public的虚函数同样会存在于虚函数表中,所以,我们同样可以使用访问虚函数表的方式来访问这些non-public的虚函数,这是很容易做到的。

如:

class Base { 
private: 
    virtual void f() { cout << "Base::f" << endl; } 
}; 

class Derive : public Base { 
}; 

typedef void(*Fun)(void); 

void main() { 
    Derive d; 
    Fun pFun = (Fun)*((int*)*(int*)(&d)+0); 
    pFun(); 
}

结束语

C++这门是一门Magic的语言,对于程序员来说,我们似乎永远摸不清楚这门语言背着我们在干了什么。需要熟悉这门语言,我们就必需要了解C++里面的那些东西,需要去了解C++中那些危险的东西。不然,这是一种搬起石头砸自己脚的编程语言。

在文章束之前还是介绍一下自己吧。我从事软件研发有十个年头了,目前是软件技术主管,技术方面,主攻Unix/C/C++,比较喜欢网络上的技术,比如分布式计算,网格计算,P2P,Ajax等一切和互联网相关的东西。管理方面比较擅长于团队建设,技术趋势分析,项目。

附录一:VC中查看虚函数表

我们可以在VC的IDE环境中的Debug状态下展开类的实例就可以看到虚函数表了(并不是很完整的)。

图 10

附录二:例程

下面是一个关于多重继承的虚函数表访问的例程:

#include <iostream> 
using namespace std; 

class Base1 { 
public: 
    virtual void f() { cout << "Base1::f" << endl; } 
    virtual void g() { cout << "Base1::g" << endl; } 
    virtual void h() { cout << "Base1::h" << endl; } 
};

class Base2 { 
public: 
    virtual void f() { cout << "Base2::f" << endl; } 
    virtual void g() { cout << "Base2::g" << endl; } 
    virtual void h() { cout << "Base2::h" << endl; } 
};

class Base3 { 
public:
    virtual void f() { cout << "Base3::f" << endl; } 
    virtual void g() { cout << "Base3::g" << endl; } 
    virtual void h() { cout << "Base3::h" << endl; } 
};

class Derive : public Base1, public Base2, public Base3 { 
public: 
    virtual void f() { cout << "Driver::f" << endl; } 
    virtual void g1() { cout << "Driver::g1" << endl; } 
};

typedef void(*Fun)(void); 

int main() 
{ 
    Fun pFun = NULL; 
    Derive d; 
    int** pVtab = (int**)&d; 
    //Base1's vtable 
    //pFun = (Fun)*((int*)*(int*)((int*)&d+0)+0); 
    pFun = (Fun)pVtab[0][0]; 
    pFun(); 
    //pFun = (Fun)*((int*)*(int*)((int*)&d+0)+1); 
    pFun = (Fun)pVtab[0][1]; 
    pFun();

    //pFun = (Fun)*((int*)*(int*)((int*)&d+0)+2); 
    pFun = (Fun)pVtab[0][2]; 
    pFun();

    //Derive's vtable 
    //pFun = (Fun)*((int*)*(int*)((int*)&d+0)+3); 
    pFun = (Fun)pVtab[0][3]; 
    pFun();

    //The tail of the vtable 
    pFun = (Fun)pVtab[0][4]; 
    cout<<pFun<<endl;

    //Base2's vtable 
    //pFun = (Fun)*((int*)*(int*)((int*)&d+1)+0); 
    pFun = (Fun)pVtab[1][0]; 
    pFun();

    //pFun = (Fun)*((int*)*(int*)((int*)&d+1)+1); 
    pFun = (Fun)pVtab[1][1]; 
    pFun();

    pFun = (Fun)pVtab[1][2]; 
    pFun();

    //The tail of the vtable 
    pFun = (Fun)pVtab[1][3]; 
    cout<<pFun<<endl;

    //Base3's vtable 
    //pFun = (Fun)*((int*)*(int*)((int*)&d+1)+0); 
    pFun = (Fun)pVtab[2][0]; 
    pFun();

    //pFun = (Fun)*((int*)*(int*)((int*)&d+1)+1); 
    pFun = (Fun)pVtab[2][1]; 
    pFun();

    pFun = (Fun)pVtab[2][2]; 
    pFun();

    //The tail of the vtable 
    pFun = (Fun)pVtab[2][3]; 
    cout<<pFun<<endl;

    return 0;
}

Trackback: http://tb.blog.csdn.net/TrackBack.aspx?PostId=2184894

近日在看虚函数的时候,碰到虚函数表与虚表指针的问题。现在总结一下。

正如我们所知道的那样,如果一个类包含了一个虚函数,那么编译器就会为该类产生一个虚拟函数表vtbl,该表是类级别的,即该类的所有对象共享同一个vtbl,且向该类的对象中安插一个指针,指向该虚函数表。例如:

class A {
    public:
    virtual void foo();
};

A a,b;

那么对象a,b的内存中各有一个vptr他们的值就是虚函数表的地址。至于vtbl放在哪里,这里先不管它。

在考虑下面的情况:

class B:public A {
};

现在的问题是,类B有虚函数表吗?

答案是:有。而且B的虚函数表和A的虚函数表不一样,也就是说,不同的类有不同的虚函数表,至于虚函数表其中的虚函数地址是什么不去管它,在上面的情况,B的虚函数表中的虚函数地址和A的是一样的。但是我们还是要为B产生一个虚函数表。

转载于:https://my.oschina.net/apoptosis/blog/83062

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值