我非常好奇于不同同步原理的性能，于是对atomic, spinlock和mutex做了如下实验来比较：

1. 无同步的情况

 #include <future>

 #include <iostream>

 volatile int value = ;

 int loop (bool inc, int limit) {

   std::cout << "Started " << inc << " " << limit << std::endl;

   for (int i = ; i < limit; ++i) {

     if (inc) {

       ++value;

     } else {

       --value;

     }

   }

   return ;

 }

 int main () {

   auto f = std::async (std::launch::async, std::bind(loop, true, ));//开启一个线程来执行loop函数，c++11的高级特性

   loop (false, );

   f.wait ();

   std::cout << value << std::endl;

 }

通过clang编译器：

 clang++ -std=c++ -stdlib=libc++ -O3 -o test test.cpp && time ./test

运行：

 SSttaarrtteedd    

 real    0m0.070s

 user    0m0.089s

 sys 0m0.002s

从运行结果很显然的我们可以看出增减不是原子性操作的，变量value最后所包含的值是不确定的（垃圾）。

2. 汇编LOCK

 #include <future>

 #include <iostream>

 volatile int value = ;

 int loop (bool inc, int limit) {

   std::cout << "Started " << inc << " " << limit << std::endl;

   for (int i = ; i < limit; ++i) {

     if (inc) {

       asm("LOCK");

       ++value;

     } else {

       asm("LOCK");

       --value;

     }

   }

   return ;

 }

 int main () {

   auto f = std::async (std::launch::async, std::bind(loop, true, )); //开启一个线程来执行loop函数，c++11的高级特性

   loop (false, );

   f.wait ();

   std::cout << value << std::endl;

 }

 SSttaarrtteedd    

 real    0m0.481s

 user    0m0.779s

 sys 0m0.005s

　　在最后变量value得到了正确的值，但是这些代码是不可移植的（平台不兼容的），只能在X86体系结构的硬件上运行，而且要想程序能正确运行编译的时候必须使用-O3编译选项。另外，由于编译器会在LOCK指令和增加或者减少指令之间注入其他指令，因此程序很容易出现“illegal instruction”异常从而导致程序被崩溃。

3. 原子操作atomic

 #include <future>

 #include <iostream>

 #include "boost/interprocess/detail/atomic.hpp"

 using namespace boost::interprocess::ipcdetail;

 volatile boost::uint32_t value = ;

 int loop (bool inc, int limit) {

   std::cout << "Started " << inc << " " << limit << std::endl;

   for (int i = ; i < limit; ++i) {

     if (inc) {

       atomic_inc32 (&value);

     } else {

       atomic_dec32 (&value);

     }

   }

   return ;

 }

 int main () {

   auto f = std::async (std::launch::async, std::bind (loop, true, ));

   loop (false, );

   f.wait ();

   std::cout << atomic_read32 (&value) << std::endl;

 }

运行：

 SSttaarrtteedd    

 real    0m0.457s

 user    0m0.734s

 sys 0m0.004s

最后结果是正确的，从所用时间来看跟汇编LOCK的差不多。当然原子操作的底层也是使用了LOCK汇编来实现的，只不过是使用了可移植的方法而已。

4. 自旋锁spinlock

 #include <future>

 #include <iostream>

 #include "boost/smart_ptr/detail/spinlock.hpp"

 boost::detail::spinlock lock;

 volatile int value = ;

 int loop (bool inc, int limit) {

   std::cout << "Started " << inc << " " << limit << std::endl;

   for (int i = ; i < limit; ++i) {

     std::lock_guard<boost::detail::spinlock> guard(lock);

     if (inc) {

       ++value;

     } else {

       --value;

     }

   }

   return ;

 }

 int main () {

   auto f = std::async (std::launch::async, std::bind (loop, true, ));

   loop (false, );

   f.wait ();

   std::cout << value << std::endl;

 }

运行:

 SSttaarrtteedd    

 real    0m0.541s

 user    0m0.675s

 sys 0m0.089s

最后结果是正确的，从用时来看比上述的慢点，但是并没有慢太多

5. 互斥锁mutex

 #include <future>

 #include <iostream>

 std::mutex mutex;

 volatile int value = ;

 int loop (bool inc, int limit) {

   std::cout << "Started " << inc << " " << limit << std::endl;

   for (int i = ; i < limit; ++i) {

     std::lock_guard<std::mutex> guard (mutex);

     if (inc) {

       ++value;

     } else {

       --value;

     }

   }

   return ;

 }

 int main () {

   auto f = std::async (std::launch::async, std::bind(loop, true, ));

   loop (false, );

   f.wait ();

   std::cout << value << std::endl;

 }

运行：

 SSttaarrtteedd    

 real    0m25.229s

 user    0m7.011s

 sys 0m22.667s

互斥锁要比前面几种的慢很多

 Benchmark

 Method    Time (sec.)

 No synchronization     0.070

 LOCK     0.481

 Atomic     0.457

 Spinlock     0.541

 Mutex     22.667

当然，测试结果会依赖于不同的平台和编译器（我是在Mac Air和clang上做的测试）。

原文链接:http://demin.ws/blog/english/2012/05/05/atomic-spinlock-mutex/

atomic, spinlock and mutex性能比较的更多相关文章

std::atomic和std::mutex区别
std::atomic介绍模板类std::atomic是C++11提供的原子操作类型,头文件 #include<atomic>.在多线程调用下,利用std::atomic可实 ...
内核必看： spinlock、 mutex 以及 semaphore
linux 内核的几种锁介绍 http://wenku.baidu.com/link?url=RdvuOpN3RPiC5aY0fKi2Xqw2MyTnpZwZbE07JriN7raJ_L6Ss8Ru1 ...
Pthreads并行编程之spin lock与mutex性能对比分析（转）
POSIX threads(简称Pthreads)是在多核平台上进行并行编程的一套常用的API.线程同步(Thread Synchronization)是并行编程中非常重要的通讯手段,其中最典型的应用 ...
spinlock，mutex,semaphore，critical section的作用与差别
某年深信服的笔试题,考的就是多线程的同步.简单的解释下方便记忆: 1.spinlock:自旋锁.是专为防止多处理器并发而引入的一种锁. 2.mutex:相互排斥量. 仅仅有拥有相互排斥对象的线程才有訪 ...
Any race is a bug. When there is a race, the compiler is free to do whatever it wants.
https://mp.weixin.qq.com/s/pVJiFdDDKVx707eKL19bjA 谈谈 Golang 中的 Data Race 原创 ms2008 poslua 2019-05-13 ...
Samsung_tiny4412(驱动笔记07)----spinlock,semaphore,atomic,mutex,completion,interrupt
/*********************************************************************************** * * spinlock,se ...
浅谈Unity的渲染优化(1)：性能分析和瓶颈判断（上篇）
http://www.taidous.com/article-667-1.html 前言首先,这个系列文章做个大致的介绍,题目"浅谈Unity",因为公司和国内大部分3D手游开发 ...
go sync.Mutex 设计思想与演化过程（一）
go语言在云计算时代将会如日中天,还抱着.NET不放的人将会被淘汰.学习go语言和.NET完全不一样,它有非常简单的runtime 和类库.最好的办法就是将整个源代码读一遍,这是我见过最简洁的系统类 ...
【linux】spinlock 的实现
一.什么是spinlock spinlock又称自旋锁,是实现保护共享资源而提出一种锁机制.自旋锁与互斥锁比较类似,都是为了解决对某项资源的互斥使用无论是互斥锁,还是自旋锁,在任何时刻,最多只能有一 ...

随机推荐

【转载】delete table 和 truncate table 的区别
使用delete语句删除数据的一般语法格式: delete [from] {table_name.view_name} [where] 将XS表中的所有行数据删除 delete XS 执行完后,发现X ...
【转载】NodeJS、NPM安装配置步骤(windows版本)
1.windows下的NodeJS安装是比较方便的(v0.6.0版本之后,支持windows native),只需要登陆官网(http://nodejs.org/),便可以看到首页的“INSTALL” ...
机器学习实战 - 读书笔记(11) - 使用Apriori算法进行关联分析
前言最近在看Peter Harrington写的"机器学习实战",这是我的学习心得,这次是第11章 - 使用Apriori算法进行关联分析. 基本概念关联分析(associat ...
sqlite3之基本操作（二）
作者:Vamei 出处:http://www.cnblogs.com/vamei 欢迎转载,也请保留这段声明.谢谢! Python自带一个轻量级的关系型数据库SQLite.这一数据库使用SQL语言.S ...
Erlang 内存泄漏分析
随着项目越来越依赖Erlang,碰到的问题也随之增加.前段时间线上系统碰到内存高消耗问题,记录一下troubleshooting的分析过程.线上系统用的是Erlang R16B02版本. 问题描述有 ...
long（Long）与int（Integer）之间的转换
最近由于在做一个众筹的项目,其中有一个查找项目支持数的接口,查找的方法定义的是一个long型的,我更新项目中的支持数的时候是int型的,所以需要在long型与int型之间转化,下面把转转化的详细方法记 ...
ahjesus 部署lighttpd
这个就不写了,直接传送门过去看,按照说的做就可以了如果你想要安装最新版的,传送门需要注意的是configure这一步,你看完他的help以后还要输入 ./configure 才能继续下一步再就是 ...
Python for循环内部实现的一个sample
#!/usr/bin/env python # -*- coding: utf-8 -*- it = iter([1,2,3,4,5]) while True: try: x = next(it) p ...
CSS布局——横向两列布局
1.固定两栏布局,使用float,注意对紧邻元素清除浮动影响.IE6在使用float布局同时设置横行margin的情况下会有双边距BUG,解决方案是加入_display:inline 代码如下: &l ...
https和http
今天登网站的时候用https登的,没登上去用http找到网站了,于是就去百度了下他俩的区别简单的画了俩图.

atomic, spinlock and mutex性能比较