gcc内嵌汇编详解

[作者：byeyear 首发：cnblogs Email：east3@163.com 转载请注明]

有时候我们希望在C/C++代码中使用嵌入式汇编，因为C中没有对应的函数或语法可用。比如我最近在ARM上写FIR程序时，需要对最后的结果进行饱和处理，但gcc没有提供ssat这样的函数，于是不得不在C代码中嵌入汇编指令。

1. 入门

在C中嵌入汇编的最大问题是如何将C语言变量与指令操作数相关联。当然，gcc都帮我们想好了。下面是是一个简单例子。

asm(“fsinx %1, %0”:”=f”(result):”f”(angle));

这里我们不需要关注fsinx指令是干啥的；只需要知道这条指令需要两个浮点寄存器作为操作数。作为专职处理C语言的gcc编译器，它是没办法知道fsinx这条汇编指令需要什么样的操作数的，这就要求程序猿告知gcc相关信息，方法就是指令后面的”=f”和”f”，表示这是两个浮点寄存器操作数。这被称为操作数规则（constraint）。规则前面加上”=”表示这是一个输出操作数，否则是输入操作数。constraint后面括号内的是与该寄存器关联的变量。这样gcc就知道如何将这条嵌入式汇编语句转成实际的汇编指令了：

fsinx：汇编指令名

%1, %0：汇编指令操作数

“=f”(result)：操作数%0是一个浮点寄存器，与变量result关联（对输出操作数，“关联”的意思就是说gcc执行完这条汇编指令后会把寄存器%0的内容送到变量result中）

“f”(angle)：操作数%1是一个浮点寄存器，与变量angle关联（对输入操作数，“关联”的意思是就是说gcc执行这条汇编指令前会先将变量angle的值读取到寄存器%1中）

因此这条嵌入式汇编会转换为至少三条汇编指令（非优化）：

1> 将angle变量的值加载到寄存器%1

2> fsinx汇编指令，源寄存器%1，目标寄存器%0

3> 将寄存器%0的值存储到变量result

当然，在高优化级别下上面的叙述可能不适用；比如源操作数可能本来就已经在某个浮点寄存器中了。

这里我们也看到constraint前加”=”符号的意义：gcc需要知道这个操作数是在执行嵌入汇编前从变量加载到寄存器，还是在执行后从寄存器存储到变量中。

常用的constraints有以下几个（更多细节参见gcc手册）：

m 内存操作数

r 寄存器操作数

i 立即数操作数（整数）

f 浮点寄存器操作数

F 立即数操作数（浮点）

从这个栗子也可以看出嵌入式汇编的基本格式：

asm(“汇编指令”:”=输出操作数规则”(关联变量):”输入操作数规则”(关联变量));

输出操作数必须为左值；这个显然。

2. 多个操作数，或没有输出操作数

如果某个指令有多个输入或输出操作数怎么办？例如arm有很多指令是三操作数指令。这个时候用逗号分隔多个规则：

asm(“add %0, %1, %2”:”=r”(sum):”r”(a), “r”(b));

每条操作数规则按顺序对应操作数%0, %1, %2。

对于没有输出操作数的情况，在汇编指令后就没有输出规则，于是就出现两个连续冒号，后跟输入规则。

3. 输入-输出（或读-写）操作数

有时候一个操作数既是输入又是输出，比如x86下的这条指令：

add %eax, %ebx

注意指令使用AT&T格式而不是Intel格式。寄存器ebx同时作为输入操作数和输出操作数。对这样的操作数，在规则前使用”+”字符：

asm("add %1, %0" : "+r"(a) : "r"(b));

对应C语言语句a=a+b。

注意这样的操作数不能使用”=”符号，因为gcc看到”=”符号会认为这是一个单输出操作数，于是在将嵌入汇编转换为真正汇编的时候就不会预先将变量a的值加载到寄存器%0中。

另一个办法是将读-写操作数在逻辑上拆分为两个操作数：

asm(“add %2, %0” : “=r”(a) : “0”(a), “r”(b));

对“逻辑”输入操作数1指定数字规则”0”，表示这个逻辑操作数占用和操作数0一样的“位置”（占用同一个寄存器）。这种方法的特点是可以将两个“逻辑”操作数关联到两个不同的C语言变量上：

asm("add %2, %0" : "=r"(c) : "0"(a), "r"(b));

对应于C程序语句c=a+b。

数字规则仅能用于输入操作数，且必须引用到输出操作数。拿上例来说，数字规则”0”位于输入规则段，且引用到输出操作数0，该数字规则自身占用操作数计数1。

这里要注意，通过同名C语言变量是无法保证两个操作数占用同一“位置”的。比如下面这样的写法是不行的:

（错误写法）asm(“add %2, %0”:”=r”(a):”r”(a), “r”(b));

4. 指定寄存器

有时候我们需要在指令中使用指定的寄存器；典型的栗子是系统调用，必须将系统调用码和参数放在指定寄存器中。为了达到这个目的，我们要在声明变量时使用扩展语法：

asm("add %1, %0" : "+r"(a) : "r"(b)); // statement 3

注意只有在执行汇编指令时能确定a在eax中，b在ebx中，其他时候a和b的存放位置是不可知的。

另外，在这么用的时候要注意，防止statement 2在执行时覆盖了eax。例如statement 2改成下面这句：

函数调用约定会将func()的返回值放在eax里，于是破坏了statement 1对a的赋值。这个时候可以先用一条语句将func返回值放在临时变量里：

int t = func();

asm("add %1, %0" : "+r"(a) : "r"(b)); // statement 3

5. 隐式改变寄存器

有的汇编指令会隐含修改一些不在指令操作数中的寄存器，为了让gcc知道这个情况，将隐式改变寄存器规则列在输入规则之后。下面是VAX机上的栗子：

asm volatile(“movc3 %0,%1,%2”

: /* no outputs */

:”g”(from),”g”(to),”g”(count)

:”r0”,”r1”,”r2”,”r3”,”r4”,”r5”);

（movc3是一条字符块移动（Move characters）指令）

这里要注意的是输入/输出规则中列出的寄存器不能和隐含改变规则中的寄存器有交叉。比如在上面的栗子里，规则“g”中就不能包含r0-r5。以指定寄存器语法声明的变量，所占用的寄存器也不能和隐含改变规则有交叉。这个应该好理解：隐含改变规则是告诉gcc有额外的寄存器需要照顾，自然不能和输入/输出寄存器有交集。

另外，如果你在指令里显式指定某个寄存器，那么这个寄存器也必须列在隐式改变规则之中（有点绕了哈）。上面我们说过gcc自身是不了解汇编指令的，所以你在指令中显式指定的寄存器，对gcc来说是隐式的，因此必须包含在隐式规则之中。另外，指令中的显式寄存器前需要一个额外的%，比如%%eax。

6. volatile

asm volatile通知gcc你的汇编指令有side effect，千万不要给优化没了，比如上面的栗子。

如果你的指令只是做些计算，那么不需要volatile，让gcc可以优化它；除此以外，无脑给每个asm加上volatile或者是个好办法。

[作者：byeyear 首发：cnblogs Email：east3@163.com 转载请注明]

gcc内嵌汇编详解的更多相关文章

ARM GCC 内嵌汇编手册
转自:http://blogold.chinaunix.net/u2/69404/showart_1922655.html ARM GCC 内嵌(inline)汇编手册关于这篇文档这篇文章是本人为方 ...
GCC内嵌汇编
http://blog.csdn.net/mydo/article/details/8279924
GCC内嵌汇编一些限制字符串
/******************/ “b”将输入变量放入ebx “c”将输入变量放入ecx “d”将输入变量放入edx “s”将输入变量放入esi “d”将输入变量放入edi “q”将输入变量放 ...
ARM GCC 内嵌（inline）汇编手册
转自:http://blogold.chinaunix.net/u2/69404/showart_1922655.html ARM GCC 内嵌(inline)汇编手册百度云:http://pan. ...
GCC嵌入式汇编（内嵌汇编）入门
GCC嵌入式汇编(内嵌汇编)入门 1. 入门在C中嵌入汇编的最大问题是如何将C语言变量与指令操作数相关联.当然,gcc都帮我们想好了.下面是是一个简单例子. asm("fsinx %1, ...
GCC在C语言中内嵌汇编 asm __volatile__ 【转】
转自:http://blog.csdn.net/pbymw8iwm/article/details/8227839 在内嵌汇编中,可以将C语言表达式指定为汇编指令的操作数,而且不用去管如何将C语言表达 ...
GCC 内联汇编（GCC内嵌ARM汇编规则）
转:http://smileleeboo.howbbs.com/posts/list/3127/81062.html 更多文档参见:http://pan.baidu.com/s/1eQ7nd8Q 有时 ...
GCC在C语言中内嵌汇编 asm __volatile__
2012-11-26 22:20 17958人阅读评论(2) 收藏举报分类: linux(59) 架构管理(24) C/C++(59) 目录(?)[+] 在内嵌汇编中,可以将C语言表达式 ...
Beennan的内嵌汇编指导（译）Brennan's Guide to Inline Assembly
注:写在前面,这是一篇翻译文章,本人的英文水平很有限,但内嵌汇编是学习操作系统不可少的知识,本人也常去查看这方面的内容,本文是在做mit的jos实验中的一篇关于内嵌汇编的介绍.关于常用的内嵌汇编(AT ...

随机推荐

Think Python - Chapter 8 - Strings
8.1 A string is a sequenceA string is a sequence of characters. You can access the characters one at ...
mysql保存中文乱码的原因和解决办法
当你遇到这个mysql保存中文乱码问题的时候,期待找到mysql保存中文乱码的原因和解决办法这样一篇能解决问题的文章是多么激动人心. 也许30%的程序员会选择自己百度,结果发现网友已经贴了很多类 ...
sql server中NULL导入decimal字段时报错
sql server中NULL导入decimal字段时报错在导入CSV文件时,如果decimal字段为null值,导致文本文件入库时失败. 错误现象构造例子新建一张表,包含decimal字段. ...
String的常规使用集合
今天先附上代码君: package com.jacob.javase; import java.io.UnsupportedEncodingException; /* *探讨String: * * ...
c语言中函数的递归
题目:用递归法把一个整数转换成字符串输出. 比较下面两种方法的不同: putchar(n%10+'0')的位置不同,造成输出结果的不同. 方法一: #include <stdio.h> v ...
rsync+inotify实现服务器数据同步
一.什么是rsync rsync,remote synchronize是一款实现远程同步功能的软件,它在同步文件的同时,可以保持原来文件的权限.时间.软硬链接等附加信息.rsync是用 “rsync算 ...
android的消息处理有三个核心类：Looper,Handler和Message。
android的消息处理机制(图+源码分析)——Looper,Handler,Message 作为一名android程序员,我学习android的一大乐趣是可以通过源码学习google大牛们的设 ...
ThinkPHP多表操作
有以下三张表,分表为pl表(uid,content),user表(id,username),lyb表(uid,title) 多表查询操作有以下几种方法: ㈠视图模型(推荐) 定义视图模型,只需要继承T ...
javascript零散要点收集
1.this永远指向函数对象的所有者 2.ECMA-262 把对象(object)定义为“属性的无序集合,每个属性存放一个原始值.对象或函数”.严格来说,这意味着对象是无特定顺序的值的数组. 3.pr ...
JSBinding + SharpKit / 常见问题
运行时出现: Return a "System.Xml.XmlIteratorNodeList" to JS failed. Did you forget to export th ...

gcc内嵌汇编详解

gcc内嵌汇编详解的更多相关文章

随机推荐

热门专题