C++ 虚函数表解析

本文涉及的产品
全局流量管理 GTM,标准版 1个月
云解析 DNS,旗舰版 1个月
公共DNS(含HTTPDNS解析),每月1000万次HTTP解析
简介:

转自:http://blog.csdn.net/haoel/article/details/1948051   本人修改部分(添加了代码验证)   在此感谢原作者 ,写出这么好的文章

(虽然转的,但是文章确实不错,所以还是脸皮厚点发到首页......,管理员,你看着办吧!!!)

前言

C++中的虚函数的作用主要是实现了多态的机制关于多态,简而言之就是用父类型别的指针指向其子类的实例,然后通过父类的指针调用实际子类的成员函数。这种技术可以让父类的指针有“多种形态”,这是一种泛型技术。所谓泛型技术,说白了就是试图使用不变的代码来实现可变的算法。比如:模板技术,RTTI技术,虚函数技术,要么是试图做到在编译时决议,要么试图做到运行时决议。

关于虚函数的使用方法,我在这里不做过多的阐述。大家可以看看相关的C++的书籍。在这篇文章中,我只想从虚函数的实现机制上面为大家 一个清晰的剖析。

 

当然,相同的文章在网上也出现过一些了,但我总感觉这些文章不是很容易阅读,大段大段的代码,没有图片,没有详细的说明,没有比较,没有举一反三。不利于学习和阅读,所以这是我想写下这篇文章的原因。也希望大家多给我提意见。

 

言归正传,让我们一起进入虚函数的世界。

虚函数表

C++ 了解的人都应该知道虚函数(Virtual Function)是通过一张虚函数表(Virtual Table)来实现的。简称为V-Table。在这个表中,主是要一个类的虚函数的地址表,这张表解决了继承、覆盖的问题,保证其容真实反应实际的函数。这样,在有虚函数的类的实例中这个表被分配在了这个实例的内存中,所以,当我们用父类的指针来操作一个子类的时候,这张虚函数表就显得由为重要了,它就像一个地图一样,指明了实际所应该调用的函数。

这里我们着重看一下这张虚函数表。C++的编译器应该是保证虚函数表的指针存在于对象实例中最前面的位置(这是为了保证取到虚函数表的有最高的性能——如果有多层继承或是多重继承的情况下)。 这意味着我们通过对象实例的地址得到这张虚函数表,然后就可以遍历其中函数指针,并调用相应的函数。

听我扯了那么多,我可以感觉出来你现在可能比以前更加晕头转向了。 没关系,下面就是实际的例子,相信聪明的你一看就明白了。

假设我们有这样的一个类:

class Base {
     public:
            virtual void f() { cout << "Base::f" << endl; }
            virtual void g() { cout << "Base::g" << endl; }
            virtual void h() { cout << "Base::h" << endl; }
 
};

按照上面的说法,我们可以通过Base的实例来得到虚函数表。 下面是实际例程:

 typedef void(*Fun)(void);
 
            Base b;
 
            Fun pFun = NULL;
 
            cout << "虚函数表地址:" << (int*)(&b) << endl;
            cout << "虚函数表 — 第一个函数地址:" << (int*)*(int*)(&b) << endl;
 
            // Invoke the first virtual function 
            pFun = (Fun)*((int*)*(int*)(&b));
            pFun();

实际运行经果如下:(Windows XP+VS2003, Linux 2.6.22 + GCC 4.1.3)

虚函数表地址:0012FED4

虚函数表 — 第一个函数地址:0044F148

Base::f

通过这个示例,我们可以看到,我们可以通过强行把&b转成int *,取得虚函数表的地址,然后,再次取址就可以得到第一个虚函数的地址了,也就是Base::f(),这在上面的程序中得到了验证(把int*强制转成了函数指针)。通过这个示例,我们就可以知道如果要调用Base::g()和Base::h(),其代码如下:

   (Fun)*((int*)*(int*)(&b)+0);  // Base::f()
            (Fun)*((int*)*(int*)(&b)+1);  // Base::g()
            (Fun)*((int*)*(int*)(&b)+2);  // Base::h()
 

这个时候你应该懂了吧。什么?还是有点晕。也是,这样的代码看着太乱了。没问题,让我画个图解释一下。如下所示:

注意:在上面这个图中,我在虚函数表的最后多加了一个结点,这是虚函数表的结束结点,就像字符串的结束符“/0”一样,其标志了虚函数表的结束。这个结束标志的值在不同的编译器下是不同的。在WinXP+VS2003下,这个值是NULL。而在Ubuntu 7.10 + Linux 2.6.22 + GCC 4.1.3下,这个值是如果1,表示还有下一个虚函数表,如果值是0,表示是最后一个虚函数表。

下面,我将分别说明“无覆盖”和“有覆盖”时的虚函数表的样子。没有覆盖父类的虚函数是毫无意义的。我之所以要讲述没有覆盖的情况,主要目的是为了给一个对比。在比较之下,我们可以更加清楚地知道其内部的具体实现。

一般继承(无虚函数覆盖)

下面,再让我们来看看继承时的虚函数表是什么样的。假设有如下所示的一个继承关系:

请注意,在这个继承关系中,子类没有重载任何父类的函数。那么,在派生类的实例中,其虚函数表如下所示:

对于实例:Derive d; 的虚函数表如下:

代码验证如下:

// CppTest.cpp : 定义控制台应用程序的入口点。
//

#include "stdafx.h"
#include <iostream>
using namespace std;

class Base{
public:
	virtual void f(){cout<<"Base::f\n";}
	virtual void g(){cout<<"Base::g\n";}
	virtual void h(){cout<<"Base::h\n";}
};

class Derive:public Base{

public:
	virtual void f1(){cout<<"Derive:f1\n";}
	virtual void g1(){cout<<"Derive:g1\n";}
	virtual void h1(){cout<<"Derive:h1\n";}
};

int _tmain(int argc, _TCHAR* argv[])
{
	typedef void(*FUN)(void);

	Base b;
	FUN pFun=NULL;

	cout<<"虚函数表的地址为:"<<(int*)(&b)<<endl;
	cout << "虚函数表 — 第一个函数地址:" << (int*)*(int*)(&b) << endl;
	for (int i=0;i<3;++i)
	{
		pFun = (FUN)*((int*)*(int*)(&b)+i);
		pFun();
	}

	cout<<"-----------------------------------------"<<endl;

	Derive d;
	pFun=NULL;

	cout<<"虚函数表的地址为:"<<(int*)(&d)<<endl;
	cout<<"虚函数表 — 第一个函数地址:"<<(int*)*(int*)(&d)<<endl;


	for (int i=0;i<6;++i)
	{
		pFun=(FUN)*((int*)*(int*)(&d)+i);
		pFun();
	}

	return 0;
}

程序的输出为:

image

我们可以看到下面几点:

1)虚函数按照其声明顺序放于表中。

2)父类的虚函数在子类的虚函数前面。 

一般继承(有虚函数覆盖)

覆盖父类的虚函数是很显然的事情,不然,虚函数就变得毫无意义。下面,我们来看一下,如果子类中有虚函数重载了父类的虚函数,会是一个什么样子?假设,我们有下面这样的一个继承关系。

为了让大家看到被继承过后的效果,在这个类的设计中,我只覆盖了父类的一个函数:f()。那么,对于派生类的实例,其虚函数表会是下面的一个样子:

代码验证如下:

#include <iostream>
using namespace std;

class Base{
public:
	virtual void f(){cout<<"Base::f\n";}
	virtual void g(){cout<<"Base::g\n";}
	virtual void h(){cout<<"Base::h\n";}
};

class Derive:public Base{

public:
	virtual void f(){cout<<"Derive:f\n";}
	virtual void g1(){cout<<"Derive:g1\n";}
	virtual void h1(){cout<<"Derive:h1\n";}
};

int _tmain(int argc, _TCHAR* argv[])
{
	typedef void(*FUN)(void);

	Base b;
	FUN pFun=NULL;

	cout<<"虚函数表的地址为:"<<(int*)(&b)<<endl;
	cout << "虚函数表 — 第一个函数地址:" << (int*)*(int*)(&b) << endl;
	for (int i=0;i<3;++i)
	{
		pFun = (FUN)*((int*)*(int*)(&b)+i);
		pFun();
	}

	cout<<"-----------------------------------------"<<endl;

	Derive d;
	pFun=NULL;

	cout<<"虚函数表的地址为:"<<(int*)(&d)<<endl;
	cout<<"虚函数表 — 第一个函数地址:"<<(int*)*(int*)(&d)<<endl;


	for (int i=0;i<5;++i)
	{
		pFun=(FUN)*((int*)*(int*)(&d)+i);
		pFun();
	}

	return 0;
}

image

我们从表中可以看到下面几点,

1)覆盖的f()函数被放到了虚表中原来父类虚函数的位置。

2)没有被覆盖的函数依旧。

这样,我们就可以看到对于下面这样的程序:

Base *b = new Derive();

b->f();

由b所指的内存中的虚函数表的f()的位置已经被Derive::f()函数地址所取代,于是在实际调用发生时,是Derive::f()被调用了。这就实现了多态。

 

多重继承(无虚函数覆盖)

下面,再让我们来看看多重继承中的情况,假设有下面这样一个类的继承关系。注意:子类并没有覆盖父类的函数。

对于子类实例中的虚函数表,是下面这个样子:

代码验证如下:

#include <iostream>
using namespace std;

class Base1{
public:
	virtual void f(){cout<<"Base1::f\n";}
	virtual void g(){cout<<"Base1::g\n";}
	virtual void h(){cout<<"Base1::h\n";}
};

class Base2{
public:
	virtual void f(){cout<<"Base2::f\n";}
	virtual void g(){cout<<"Base2::g\n";}
	virtual void h(){cout<<"Base2::h\n";}
};

class Base3{
public:
	virtual void f(){cout<<"Base3::f\n";}
	virtual void g(){cout<<"Base3::g\n";}
	virtual void h(){cout<<"Base3::h\n";}
};


class Derive:public Base1,Base2,Base3{

public:
	virtual void f1(){cout<<"Derive:f1\n";}
	virtual void g1(){cout<<"Derive:g1\n";}
	virtual void h1(){cout<<"Derive:h1\n";}
};

int _tmain(int argc, _TCHAR* argv[])
{
	typedef void(*FUN)(void);

	Derive d;
	FUN pFun=NULL;
	cout<<"虚函数表的地址为:"<<(int*)(&d)<<endl;
	cout << "虚函数表 — 第一个函数地址:" << (int*)*(int*)(&d) << endl;

	for (int i=0;i<6;++i)
	{
		pFun = (FUN)*((int*)*(int*)(&d)+i);
		pFun();
	}

	cout<<"----------------------------"<<endl;

	for (int i=0;i<3;++i)
	{
		pFun = (FUN)*((int*)*((int*)(&d)+1)+i);
		pFun();
	}

	cout<<"----------------------------"<<endl;

	for (int i=0;i<3;++i)
	{
		pFun = (FUN)*((int*)*((int*)(&d)+2)+i);
		pFun();
	}

	cout<<"----------------------------"<<endl;

	return 0;
}

结果如下:

image

多重继承(有虚函数覆盖)

下面我们再来看看,如果发生虚函数覆盖的情况。

下图中,我们在子类中覆盖了父类的f()函数。

下面是对于子类实例中的虚函数表的图:

代码验证如下:

#include <iostream>
using namespace std;

class Base1{
public:
	virtual void f(){cout<<"Base1::f\n";}
	virtual void g(){cout<<"Base1::g\n";}
	virtual void h(){cout<<"Base1::h\n";}
};

class Base2{
public:
	virtual void f(){cout<<"Base2::f\n";}
	virtual void g(){cout<<"Base2::g\n";}
	virtual void h(){cout<<"Base2::h\n";}
};

class Base3{
public:
	virtual void f(){cout<<"Base3::f\n";}
	virtual void g(){cout<<"Base3::g\n";}
	virtual void h(){cout<<"Base3::h\n";}
};


class Derive:public Base1,Base2,Base3{

public:
	virtual void f(){cout<<"Derive::f\n";}
	virtual void g1(){cout<<"Derive::g1\n";}
	virtual void h1(){cout<<"Derive::h1\n";}
};

int _tmain(int argc, _TCHAR* argv[])
{
	typedef void(*FUN)(void);

	Derive d;
	FUN pFun=NULL;
	cout<<"虚函数表的地址为:"<<(int*)(&d)<<endl;
	cout << "虚函数表 — 第一个函数地址:" << (int*)*(int*)(&d) << endl;

	for (int i=0;i<5;++i)
	{
		pFun = (FUN)*((int*)*(int*)(&d)+i);
		pFun();
	}

	cout<<"----------------------------"<<endl;

	for (int i=0;i<3;++i)
	{
		pFun = (FUN)*((int*)*((int*)(&d)+1)+i);
		pFun();
	}

	cout<<"----------------------------"<<endl;

	for (int i=0;i<3;++i)
	{
		pFun = (FUN)*((int*)*((int*)(&d)+2)+i);
		pFun();
	}

	cout<<"----------------------------"<<endl;

	return 0;
}

结果为:

image

 

我们可以看见,三个父类虚函数表中的f()的位置被替换成了子类的函数指针。这样,我们就可以任一静态类型的父类来指向子类,并调用子类的f()了。如:

  			 Derive d;
            Base1 *b1 = &d;
            Base2 *b2 = &d;
            Base3 *b3 = &d;
            b1->f(); //Derive::f()
            b2->f(); //Derive::f()
            b3->f(); //Derive::f()
 
            b1->g(); //Base1::g()
            b2->g(); //Base2::g()
            b3->g(); //Base3::g(

安全性

每次写C++的文章,总免不了要批判一下C++。这篇文章也不例外。通过上面的讲述,相信我们对虚函数表有一个比较细致的了解了。水可载舟,亦可覆舟。下面,让我们来看看我们可以用虚函数表来干点什么坏事吧。

一、通过父类型的指针访问子类自己的虚函数

我们知道,子类没有重载父类的虚函数是一件毫无意义的事情。因为多态也是要基于函数重载的。虽然在上面的图中我们可以看到Base1的虚表中有Derive的虚函数,但我们根本不可能使用下面的语句来调用子类的自有虚函数:

 Base1 *b1 = new Derive();
            b1->f1();  //编译出错
 

任何妄图使用父类指针想调用子类中的未覆盖父类的成员函数的行为都会被编译器视为非法,所以,这样的程序根本无法编译通过。但在运行时,我们可以通过指针的方式访问虚函数表来达到违反C++语义的行为。(关于这方面的尝试,通过阅读后面附录的代码,相信你可以做到这一点)

 

二、访问non-public的虚函数

另外,如果父类的虚函数是private或是protected的,但这些非public的虚函数同样会存在于虚函数表中,所以,我们同样可以使用访问虚函数表的方式来访问这些non-public的虚函数,这是很容易做到的。

#include <iostream>
using namespace std;

class Base {
private:
	virtual void f() { cout << "Base::f" << endl; }

};

class Derive : public Base{

};

int _tmain(int argc, _TCHAR* argv[])
{
	typedef void(*Fun)(void);

	Derive d;
	Fun  pFun = (Fun)*((int*)*(int*)(&d)+0);
	pFun();

	return 0;
}

结束语

C++这门语言是一门Magic的语言,对于程序员来说,我们似乎永远摸不清楚这门语言背着我们在干了什么。需要熟悉这门语言,我们就必需要了解C++里面的那些东西,需要去了解C++中那些危险的东西。不然,这是一种搬起石头砸自己脚的编程语言。

 

附录一:VC中查看虚函数表

我们可以在VC的IDE环境中的Debug状态下展开类的实例就可以看到虚函数表了(并不是很完整的)


==============================================================================
本文转自被遗忘的博客园博客,原文链接:http://www.cnblogs.com/rollenholt/archive/2012/04/26/2472050.html,如需转载请自行联系原作者
相关文章
|
3天前
|
存储 算法 安全
基于红黑树的局域网上网行为控制C++ 算法解析
在当今网络环境中,局域网上网行为控制对企业和学校至关重要。本文探讨了一种基于红黑树数据结构的高效算法,用于管理用户的上网行为,如IP地址、上网时长、访问网站类别和流量使用情况。通过红黑树的自平衡特性,确保了高效的查找、插入和删除操作。文中提供了C++代码示例,展示了如何实现该算法,并强调其在网络管理中的应用价值。
|
2月前
|
自然语言处理 编译器 Linux
|
2月前
|
设计模式 安全 数据库连接
【C++11】包装器:深入解析与实现技巧
本文深入探讨了C++中包装器的定义、实现方式及其应用。包装器通过封装底层细节,提供更简洁、易用的接口,常用于资源管理、接口封装和类型安全。文章详细介绍了使用RAII、智能指针、模板等技术实现包装器的方法,并通过多个案例分析展示了其在实际开发中的应用。最后,讨论了性能优化策略,帮助开发者编写高效、可靠的C++代码。
40 2
|
17天前
|
安全 编译器 C++
C++ `noexcept` 关键字的深入解析
`noexcept` 关键字在 C++ 中用于指示函数不会抛出异常,有助于编译器优化和提高程序的可靠性。它可以减少代码大小、提高执行效率,并增强程序的稳定性和可预测性。`noexcept` 还可以影响函数重载和模板特化的决策。使用时需谨慎,确保函数确实不会抛出异常,否则可能导致程序崩溃。通过合理使用 `noexcept`,开发者可以编写出更高效、更可靠的 C++ 代码。
25 0
|
17天前
|
存储 程序员 C++
深入解析C++中的函数指针与`typedef`的妙用
本文深入解析了C++中的函数指针及其与`typedef`的结合使用。通过图示和代码示例,详细介绍了函数指针的基本概念、声明和使用方法,并展示了如何利用`typedef`简化复杂的函数指针声明,提升代码的可读性和可维护性。
50 0
|
2月前
|
自然语言处理 编译器 Linux
告别头文件,编译效率提升 42%!C++ Modules 实战解析 | 干货推荐
本文中,阿里云智能集团开发工程师李泽政以 Alinux 为操作环境,讲解模块相比传统头文件有哪些优势,并通过若干个例子,学习如何组织一个 C++ 模块工程并使用模块封装第三方库或是改造现有的项目。
|
3月前
|
存储 编译器 C++
【C++篇】揭开 C++ STL list 容器的神秘面纱:从底层设计到高效应用的全景解析(附源码)
【C++篇】揭开 C++ STL list 容器的神秘面纱:从底层设计到高效应用的全景解析(附源码)
85 2
|
2月前
|
监控 Java 应用服务中间件
高级java面试---spring.factories文件的解析源码API机制
【11月更文挑战第20天】Spring Boot是一个用于快速构建基于Spring框架的应用程序的开源框架。它通过自动配置、起步依赖和内嵌服务器等特性,极大地简化了Spring应用的开发和部署过程。本文将深入探讨Spring Boot的背景历史、业务场景、功能点以及底层原理,并通过Java代码手写模拟Spring Boot的启动过程,特别是spring.factories文件的解析源码API机制。
87 2
|
10天前
|
存储 设计模式 算法
【23种设计模式·全精解析 | 行为型模式篇】11种行为型模式的结构概述、案例实现、优缺点、扩展对比、使用场景、源码解析
行为型模式用于描述程序在运行时复杂的流程控制,即描述多个类或对象之间怎样相互协作共同完成单个对象都无法单独完成的任务,它涉及算法与对象间职责的分配。行为型模式分为类行为模式和对象行为模式,前者采用继承机制来在类间分派行为,后者采用组合或聚合在对象间分配行为。由于组合关系或聚合关系比继承关系耦合度低,满足“合成复用原则”,所以对象行为模式比类行为模式具有更大的灵活性。 行为型模式分为: • 模板方法模式 • 策略模式 • 命令模式 • 职责链模式 • 状态模式 • 观察者模式 • 中介者模式 • 迭代器模式 • 访问者模式 • 备忘录模式 • 解释器模式
【23种设计模式·全精解析 | 行为型模式篇】11种行为型模式的结构概述、案例实现、优缺点、扩展对比、使用场景、源码解析
|
10天前
|
设计模式 存储 安全
【23种设计模式·全精解析 | 创建型模式篇】5种创建型模式的结构概述、实现、优缺点、扩展、使用场景、源码解析
结构型模式描述如何将类或对象按某种布局组成更大的结构。它分为类结构型模式和对象结构型模式,前者采用继承机制来组织接口和类,后者釆用组合或聚合来组合对象。由于组合关系或聚合关系比继承关系耦合度低,满足“合成复用原则”,所以对象结构型模式比类结构型模式具有更大的灵活性。 结构型模式分为以下 7 种: • 代理模式 • 适配器模式 • 装饰者模式 • 桥接模式 • 外观模式 • 组合模式 • 享元模式
【23种设计模式·全精解析 | 创建型模式篇】5种创建型模式的结构概述、实现、优缺点、扩展、使用场景、源码解析

推荐镜像

更多