2007-06-23 20:06
------by styx <参考了馨荣家园中的一篇文章,自己修正和补充之,对作者致以谢意>
在C语言中,假设我们有这样的一个函数:
int function(int a,int b);
假设其其调用者为main函数,代码如下:
Int main()
{
function(1, 2);
return 0;
}
当高级语言被编译成计算机可以识别的机器码时,有一个问题就凸现出来:在CPU中,计算机没有办法知道一个函数调用需要多少个、什么样的参数,也没有硬件可以保存这些参数。也就是说,计算机不知道怎么给这个函数传递参数,传递参数的工作必须由函数调用者和函数本身来协调。为此,计算机提供了一种被称为栈的数据结构来支持参数传递。
栈是一种先进后出的数据结构,栈有一个存储区、一个栈顶指针。栈顶指针指向堆栈中第一个可用的数据项(被称为栈顶)。用户可以在栈顶上方向栈中加入数据,这个操作被称为压栈(Push),压栈以后,栈顶自动变成新加入数据项的位置,栈顶指针也随之修改。用户也可以从堆栈中取走栈顶,称为弹出栈(pop),弹出栈后,栈顶下的一个元素变成栈顶,栈顶指针随之修改。
函数调用时,调用者依次把参数压栈,然后调用函数,函数被调用以后,在堆栈中取得数据,并进行计算。函数计算结束以后,或者调用者、或者函数本身修改堆栈,使堆栈恢复原装。在参数传递中,有两个很重要的问题必须得到明确说明:
l 当参数个数多于一个时,按照什么顺序把参数压入堆栈
l 函数调用后,由谁来把堆栈恢复原装
在高级语言中,通过函数调用约定来说明这两个问题。常见的调用约定有:
1 stdcall
2 cdecl
3 fastcall
4 thiscall
5 naked call
stdcall调用约定
stdcall很多时候被称为pascal调用约定,因为pascal是早期很常见的一种教学用计算机程序设计语言,其语法严谨,使用的函数调用约定就是stdcall。在Microsoft C++系列的C/C++编译器中,常常用PASCAL宏来声明这个调用约定,类似的宏还有WINAPI和CALLBACK。
stdcall调用约定声明的语法为(以前文的那个函数为例):
int __stdcall function(int a,int b)
stdcall的调用约定意味着:
l 参数从右向左压入堆栈
l 函数自身修改堆栈
l 函数名自动加前导的下划线,后面紧跟一个@符号,其后紧跟着参数的尺寸
以上述这个函数为例,参数b首先被压栈,然后是参数a,函数调用function(1,2)调用处翻译成汇编语言将变成:
push 2 第二个参数入栈
push 1 第一个参数入栈
call function 调用参数,注意此时自动把cs:eip入栈
而对于函数function自身,则可以翻译为:
push ebp 保存ebp寄存器,该寄存器将用来保存调用函数堆栈的
栈顶指针,可以在函数退出时恢复
mov ebp, esp 保存堆栈指针
mov eax, [ebp + 8H]
堆栈中ebp指向位置之前依次保存有ebp, cs:eip, a, b;ebp+8指向a;
add eax, [ebp + 0CH] 堆栈中ebp + 12处保存了b,此处就是运算a+b;
mov esp, ebp 恢复esp
pop ebp
ret 8 函数体负责清栈;两个int型参数共用了8byte空间的堆栈
而在编译时,这个函数的名字被翻译成_function@8
注意不同编译器会插入自己的汇编代码以提供编译的通用性,但是大体代码如此。其中在函数开始处保留esp到ebp中,在函数结束恢复是编译器常用的方法。
从函数调用看,2和1依次被push进堆栈,而在函数中又通过相对于ebp(即刚进函数时的堆栈指针)的偏移量存取参数。函数结束后,ret 8表示清理8个字节的堆栈,函数自己恢复了堆栈。< Why 8 bytes? >
没有评论:
发表评论