C++虚函数表解析

最新推荐文章于 2020-12-25 09:40:09 发布

damotiansheng

最新推荐文章于 2020-12-25 09:40:09 发布

阅读量543

点赞数 1

分类专栏： C++

C++ 专栏收录该内容

8 篇文章 1 订阅

订阅专栏

前言

C++中的虚函数的作用主要是实现了多态的机制。关于多态，简而言之就是用父类型别的指针指向其子类的实例，然后通过父类的指针调用实际子类的成员函数。这种技术可以让父类的指针有“多种形态”，这是一种泛型技术。所谓泛型技术，说白了就是试图使用不变的代码来实现可变的算法。比如：模板技术，RTTI技术，虚函数技术，要么是试图做到在编译时决议，要么试图做到运行时决议。

关于虚函数的使用方法，我在这里不做过多的阐述。大家可以看看相关的C++的书籍。在这篇文章中，我只想从虚函数的实现机制上面为大家一个清晰的剖析。

当然，相同的文章在网上也出现过一些了，但我总感觉这些文章不是很容易阅读，大段大段的代码，没有图片，没有详细的说明，没有比较，没有举一反三。不利于学习和阅读，所以这是我想写下这篇文章的原因。也希望大家多给我提意见。

言归正传，让我们一起进入虚函数的世界。

虚函数表

对C++ 了解的人都应该知道虚函数（Virtual Function）是通过一张虚函数表（Virtual Table）来实现的。简称为V-Table。在这个表中，主是要一个类的虚函数的地址表，这张表解决了继承、覆盖的问题，保证其容真实反应实际的函数。这样，在有虚函数的类的实例中这个表被分配在了这个实例的内存中，所以，当我们用父类的指针来操作一个子类的时候，这张虚函数表就显得由为重要了，它就像一个地图一样，指明了实际所应该调用的函数。

这里我们着重看一下这张虚函数表。C++的编译器应该是保证虚函数表的指针存在于对象实例中最前面的位置（这是为了保证取到虚函数表的有最高的性能——如果有多层继承或是多重继承的情况下）。这意味着我们通过对象实例的地址得到这张虚函数表，然后就可以遍历其中函数指针，并调用相应的函数。

听我扯了那么多，我可以感觉出来你现在可能比以前更加晕头转向了。没关系，下面就是实际的例子，相信聪明的你一看就明白了。

代码如下：

#include <iostream>
using namespace std;

class Base 
{
	public:
		Base(){ data = 1; }
        virtual void f() { cout << "Base::f" << endl; }
        virtual void g() { cout << "Base::g" << endl; }
        virtual void h() { cout << "Base::h" << endl; }
        
    public:
		int data;
 
};

class Derive : public Base
{
	public:
		virtual void f1() { cout << "Derive::f1" << endl; }
        virtual void g1() { cout << "Derive::g1" << endl; }
        virtual void h1() { cout << "Derive::h1" << endl; }
};

int main()
{
	typedef void(*Fun)(void);
    Base b;
    Fun pFun = NULL;
    cout << "虚函数表地址：" << (int *)( *(int*)&b ) << endl;
    cout << *( (int *)&b + 1 ) << endl; //输出b.data 等价于cout << b.data << endl; 输出1
	 
    // cout << "虚函数表地址：" << (int**)(&b) << endl;
    cout << "虚函数表 — 第一个函数地址：" << (int *)*( (int *)*(int*)&b  ) << endl; //这里指的是第一个虚函数指针，即通过它可以实现调用该虚函数
    // cout << "虚函数表 — 第一个函数的首地址：" << ( (int *)*(int*)&b + 0 ) << endl; 这里指的是存放第一个虚函数指针的地址，为指针的地址
    // Invoke the first virtual function 
    pFun = (Fun)*(*(int**)(&b));
    (*pFun)(); //调用Base::f
    cout << (int*)pFun << endl;
    cout << (int*)(*pFun) << endl; //输出值和(int*)pFun一样
	
	//Invoke the second virtual function 
    pFun = (Fun)*( ( *(int**)(&b) ) + 1 ); 
    pFun(); //调用Base::g 
    
    // Invoke the third virtual funcion
    pFun = (Fun)*( ( *(int**)(&b) ) + 2 ); 
    pFun(); //调用Base::h 
    
    cout << "----------------------------------" << endl;
    Derive d;
    pFun = (Fun)*( ( *(int**)(&d) ) + 0 );
    pFun(); //调用Base::f 
    
    pFun = (Fun)*( ( *(int**)(&d) ) + 1 );
    pFun(); //调用Base::g 
    
    pFun = (Fun)*( ( *(int**)(&d) ) + 2 );
    pFun();//调用Base::h 
    
    pFun = (Fun)*( ( *(int**)(&d) ) + 3 );
    pFun(); //调用Derive::f 
    
    pFun = (Fun)*( ( *(int**)(&d) ) + 4 );
    pFun();//调用Derive::g
    
    pFun = (Fun)*( ( *(int**)(&d) ) + 5 );
    pFun();//调用Derive::h 
	 
	system("pause");
	return 0;
}

注意：在上面这个图中，我在虚函数表的最后多加了一个结点，这是虚函数表的结束结点，就像字符串的结束符“/0”一样，其标志了虚函数表的结束。这个结束标志的值在不同的编译器下是不同的。在WinXP+VS2003下，这个值是NULL。而在Ubuntu 7.10 + Linux 2.6.22 + GCC 4.1.3下，这个值是如果1，表示还有下一个虚函数表，如果值是0，表示是最后一个虚函数表。

下面，我将分别说明“无覆盖”和“有覆盖”时的虚函数表的样子。没有覆盖父类的虚函数是毫无意义的。我之所以要讲述没有覆盖的情况，主要目的是为了给一个对比。在比较之下，我们可以更加清楚地知道其内部的具体实现。

一般继承（无虚函数覆盖）

下面，再让我们来看看继承时的虚函数表是什么样的。假设有如下所示的一个继承关系：

请注意，在这个继承关系中，子类没有重载任何父类的函数。那么，在派生类的实例中，其虚函数表如下所示：

对于实例：Derive d; 的虚函数表如下：

我们可以看到下面几点：

1）虚函数按照其声明顺序放于表中。

2）父类的虚函数在子类的虚函数前面。

我相信聪明的你一定可以参考前面的那个程序，来编写一段程序来验证。

一般继承（有虚函数覆盖）

覆盖父类的虚函数是很显然的事情，不然，虚函数就变得毫无意义。下面，我们来看一下，如果子类中有虚函数重载了父类的虚函数，会是一个什么样子？假设，我们有下面这样的一个继承关系。

为了让大家看到被继承过后的效果，在这个类的设计中，我只覆盖了父类的一个函数：f()。那么，对于派生类的实例，其虚函数表会是下面的一个样子：

我们从表中可以看到下面几点，

1）覆盖的f()函数被放到了虚表中原来父类虚函数的位置。

2）没有被覆盖的函数依旧。

这样，我们就可以看到对于下面这样的程序，

Base *b = new Derive();

b->f();

由b所指的内存中的虚函数表的f()的位置已经被Derive::f()函数地址所取代，于是在实际调用发生时，是Derive::f()被调用了。这就实现了多态。

多重继承（无虚函数覆盖）

下面，再让我们来看看多重继承中的情况，假设有下面这样一个类的继承关系。注意：子类并没有覆盖父类的函数。

对于子类实例中的虚函数表，是下面这个样子：

我们可以看到：

1）每个父类都有自己的虚表。

2）子类的成员函数被放到了第一个父类的表中。（所谓的第一个父类是按照声明顺序来判断的）

这样做就是为了解决不同的父类类型的指针指向同一个子类实例，而能够调用到实际的函数。

多重继承（有虚函数覆盖）

下面我们再来看看，如果发生虚函数覆盖的情况。

下图中，我们在子类中覆盖了父类的f()函数。

下面是对于子类实例中的虚函数表的图：

我们可以看见，三个父类虚函数表中的f()的位置被替换成了子类的函数指针。这样，我们就可以任一静态类型的父类来指向子类，并调用子类的f()了。如：

Derive d;

Base1 *b1 = &d;

Base2 *b2 = &d;

Base3 *b3 = &d;

b1->f(); //Derive::f()

b2->f(); //Derive::f()

b3->f(); //Derive::f()

b1->g(); //Base1::g()

b2->g(); //Base2::g()

b3->g(); //Base3::g()

上图中子类对象d前三个指针为虚表指针，前提是基类Base1和Base2无数据成员，若有数据成员，则三个虚表指针不是连续的，若下面代码所示：

#include <iostream>
using namespace std;

class Base1 
{
	public:
		Base1(){ data1 = 1; }
        virtual void f() { cout << "Base1::f" << endl; }
        virtual void g() { cout << "Base1::g" << endl; }
        virtual void h() { cout << "Base1::h" << endl; }
    
    public:
		int data1;
   
 
};


class Base2 
{
	public:
		Base2(){ data2 = 2; }
        virtual void f() { cout << "Base2::f" << endl; }
        virtual void g() { cout << "Base2::g" << endl; }
        virtual void h() { cout << "Base2::h" << endl; }
        
    public:
		int data2;
 
};


class Base3 
{
	public:
		Base3(){ data3 = 3; }
        virtual void f() { cout << "Base3::f" << endl; }
        virtual void g() { cout << "Base3::g" << endl; }
        virtual void h() { cout << "Base3::h" << endl; }
        
    public:
		int data3;
 
};


class Derive : public Base1, public Base2, public Base3
{
	public:
		Derive(){ data4 = 4; }
		virtual void f1() { cout << "Derive::f1" << endl; }
        virtual void g1() { cout << "Derive::g1" << endl; }
        
    public:
		int data4;
};

int main()
{
 	typedef void(*Fun)(void);
    Derive d;
    Base1 *b1 = &d;
    //b1->f1(); //编译出错，无法调用 
    int *p = NULL;
    Fun pFun = NULL;
    
    p = (int *)&d;
    pFun = (Fun)*( (int *)(*p) + 1 ); 
    pFun(); // 调用Base1::g 
    
    pFun = (Fun)*( ( *(int**)(&d) ) + 3 ); 
    pFun(); //调用Derivd::f1 
    cout << "Base1::data1: " << *( p + 1 ) << endl; //输出继承于Base1中的data1，等价于cout << d.data1 << endl;

	//The tail of the vtable
 	pFun = (Fun)*( ( *(int**)(&d) ) + 5 ); 
 	cout << pFun << endl;
    
    
    cout << "-------------Base2-------------------" << endl;
    p = (int *)&d + 2;
    //cout << *(int *)p << endl;
    pFun = (Fun)*( (int *)(*p) + 0 );
    pFun(); //调用Base2::f
	
	pFun = (Fun)*( (int *)(*p) + 1 );
    pFun(); //调用Base2::g
    
    pFun = (Fun)*( (int *)(*p) + 2 );
    pFun(); //调用Base2::h
    
    p = (int *)&d + 3;
    cout << "Base2::data2: "<< *p << endl; //输出继承于Base2中的data2，等价于cout << d.data2 << endl;
    
    cout << "---------------Base3-----------------" << endl;
    p = (int *)&d + 4;
    pFun = (Fun)*( (int *)(*p) + 0 );
    pFun(); //调用Base3::f
    
    pFun = (Fun)*( (int *)(*p) + 1 );
    pFun(); //调用Base3::g
    
    pFun = (Fun)*( (int *)(*p) + 2 );
    pFun(); //调用Base3::h
    
    p = (int *)&d + 5;
    cout << "Base3::data3: "<< *p << endl; //输出继承于Base3中的data3，等价于cout << d.data3 << endl;
    
    p = (int *)&d + 6;
    cout << "Derive::data4: "<< *p << endl; //输出Derive类中的data4，等价于cout << d.data4 << endl;
     
    system("pause");
	return 0;
}

上面代码虚函数表如下图所示：

运行结果如下：

安全性

每次写C++的文章，总免不了要批判一下C++。这篇文章也不例外。通过上面的讲述，相信我们对虚函数表有一个比较细致的了解了。水可载舟，亦可覆舟。下面，让我们来看看我们可以用虚函数表来干点什么坏事吧。

一、通过父类型的指针访问子类自己的虚函数

我们知道，子类没有重载父类的虚函数是一件毫无意义的事情。因为多态也是要基于函数重载的。虽然在上面的图中我们可以看到Base1的虚表中有Derive的虚函数，但我们根本不可能使用下面的语句来调用子类的自有虚函数：

Base1 *b1 = new Derive();

b1->f1(); //编译出错

任何妄图使用父类指针想调用子类中的未覆盖父类的成员函数的行为都会被编译器视为非法，所以，这样的程序根本无法编译通过。但在运行时，我们可以通过指针的方式访问虚函数表来达到违反C++语义的行为。（关于这方面的尝试，通过阅读后面附录的代码，相信你可以做到这一点）

二、访问non-public的虚函数

另外，如果父类的虚函数是private或是protected的，但这些非public的虚函数同样会存在于虚函数表中，所以，我们同样可以使用访问虚函数表的方式来访问这些non-public的虚函数，这是很容易做到的。

如：

class Base {

private:

virtual void f() { cout << "Base::f" << endl; }

};

class Derive : public Base{

};

typedef void(*Fun)(void);

void main() {

Derive d;

Fun pFun = (Fun)*((int*)*(int*)(&d)+0);

pFun();

}

typedef void(*Fun)(void);   //void类型的函数指针  
  
class Base   
{  
public:  
    virtual void f() { cout << "Base::f" << endl; }  
    virtual void g() { cout << "Base::g" << endl; }  
    virtual void h() { cout << "Base::h" << endl; }  
private:  
    virtual void j() { cout << "Base::j" << endl;}  
};  
  
class dev: public Base  
{  
public:  
    virtual void k() { cout << "dev::k" << endl; }  
};  
  
int main()  
{  
      
    //Base b1;  
    //b1.j();            //compile error  
    dev d;  
    //d.f();             //compile error  
    //通过函数指针访问到私有的j(), j()对于对象来讲本来是不可见的,指针太强大  
    Fun pFun2 = (Fun)*((int*)*(int*)(&d)+3);   
    pFun2();  
  
    Base *b2 = new dev();  
    //b2->k();           //compile error,父类指针无法call子类特有的虚函数  
    //通过函数指针访问到子类特有的虚函数k(), 指针太强大  
    Fun pFun3 = (Fun)*((int*)*(int*)b2+4);   
    pFun3();  
  
    return 0;  
}

附录 二：例程
下面是一个关于多重继承的虚函数表访问的例程：
 
#include <iostream>
using namespace std;
 
class Base1 {
public:
            virtual void f() { cout << "Base1::f" << endl; }
            virtual void g() { cout << "Base1::g" << endl; }
            virtual void h() { cout << "Base1::h" << endl; }
 
};
 
class Base2 {
public:
            virtual void f() { cout << "Base2::f" << endl; }
            virtual void g() { cout << "Base2::g" << endl; }
            virtual void h() { cout << "Base2::h" << endl; }
};
 
class Base3 {
public:
            virtual void f() { cout << "Base3::f" << endl; }
            virtual void g() { cout << "Base3::g" << endl; }
            virtual void h() { cout << "Base3::h" << endl; }
};
 
 
class Derive : public Base1, public Base2, public Base3 {
public:
            virtual void f() { cout << "Derive::f" << endl; }
            virtual void g1() { cout << "Derive::g1" << endl; }
};
 
 
typedef void(*Fun)(void);
 
int main()
{
            Fun pFun = NULL;
 
            Derive d;
            int** pVtab = (int**)&d;
 
            //Base1's vtable
            //pFun = (Fun)*((int*)*(int*)((int*)&d+0)+0);
            pFun = (Fun)pVtab[0][0];
            pFun();
 
            //pFun = (Fun)*((int*)*(int*)((int*)&d+0)+1);
            pFun = (Fun)pVtab[0][1];
            pFun();
 
            //pFun = (Fun)*((int*)*(int*)((int*)&d+0)+2);
            pFun = (Fun)pVtab[0][2];
            pFun();
 
            //Derive's vtable
            //pFun = (Fun)*((int*)*(int*)((int*)&d+0)+3);
            pFun = (Fun)pVtab[0][3];
            pFun();
 
            //The tail of the vtable
            pFun = (Fun)pVtab[0][4];
            cout<<pFun<<endl;
 
 
            //Base2's vtable
            //pFun = (Fun)*((int*)*(int*)((int*)&d+1)+0);
            pFun = (Fun)pVtab[1][0];
            pFun();
 
            //pFun = (Fun)*((int*)*(int*)((int*)&d+1)+1);
            pFun = (Fun)pVtab[1][1];
            pFun();
 
            pFun = (Fun)pVtab[1][2];
            pFun();
 
            //The tail of the vtable
            pFun = (Fun)pVtab[1][3];
            cout<<pFun<<endl;
 
 
 
            //Base3's vtable
            //pFun = (Fun)*((int*)*(int*)((int*)&d+1)+0);
            pFun = (Fun)pVtab[2][0];
            pFun();
 
            //pFun = (Fun)*((int*)*(int*)((int*)&d+1)+1);
            pFun = (Fun)pVtab[2][1];
            pFun();
 
            pFun = (Fun)pVtab[2][2];
            pFun();
 
            //The tail of the vtable
            pFun = (Fun)pVtab[2][3];
            cout<<pFun<<endl;
 
            return 0;
}

注：注意的是，编译器会为每个有虚函数的类创建一个虚函数表，该虚函数表将被该类的所有对象共享。类的每个虚成员占据虚函数表中的一行。如果类中有N个虚函数，那么其虚函数表将有N*4字节的大小。

转载来源：http://blog.csdn.net/haoel/article/details/1948051