"atomic_lock.h"
 #pragma once
 #ifndef _atomic_lock_h_include_
 #define _atomic_lock_h_include_

 #define spin_num (2048)

 #ifdef _MSC_VER

 #include <windows.h>

 #define cpu_pause()  __asm {pause}
 #define thread_yield()         Yield()

 __forceinline int compare_and_swap(long volatile *des, long out, long set)
 {
     InterlockedCompareExchange(des, set, out);
     return *des == set;
 }

 #endif

 #ifdef __GNUC__

 #include <sched.h>

 #define cpu_pause()  __asm__ ("pause")
 #define thread_yield()       sched_yield()

 #if defined(__INTEL_COMPILER) || (__GNUC__ > 4) || ((__GNUC__ == 4) && (__GNUC_MINOR__ >= 1))
 #define USE_BUILTINS
 #endif

 static inline int compare_and_swap(volatile long* x, long oldval, long newval) {
 #ifdef USE_BUILTINS
     return    __sync_bool_compare_and_swap(x, oldval, newval);
 #elif defined(__i386__)
     char result;
     asm volatile ("lock; cmpxchgl %3, %0; setz %1" : "=m"(*x), "=q" (result) : "m" (*x), "r" (newval), "a" (oldval) : "memory");
     return result;
 #elif defined(__x86_64__)
     char result;
     asm volatile ("lock; cmpxchgq %3, %0; setz %1" : "=m"(*x), "=q" (result) : "m" (*x), "r" (newval), "a" (oldval) : "memory");
     return result;
 #else
 #error architecture not supported and gcc too old.
 #endif
 }

 #endif

 typedef struct {
     volatile long   lock;
 } app_atomic_lock_t;

 int app_atomic_trylock(app_atomic_lock_t* lt, long value);

 void app_atomic_lock(app_atomic_lock_t* lt, long value);

 void app_atomic_unlock(app_atomic_lock_t* lt, long value);
 #endif

"atomic_lock.c"
 #include "atomic_lock.h"

 int app_atomic_trylock(app_atomic_lock_t * lt, long value)
 {
      &&
          compare_and_swap(&lt-> }

 void app_atomic_lock(app_atomic_lock_t * lt, long value)
 {
     u_int n, i;

     for (;; ) {

          && compare_and_swap(&lt->, value)) {
             return;
         }
         ; n < spin_num; n <<= ) {

             ; i < n; i++) {
                 cpu_pause();
             }

              && compare_and_swap(&lt->, value)) {
                 return;
             }
         }

         thread_yield();
     }
 }

 void app_atomic_unlock(app_atomic_lock_t * lt, long value)
 {
     compare_and_swap(&lt->);
 }
#include "atomic_lock.h"

app_atomic_lock_t lock;
volatile int value;

void* th_fun(void *arg)
{
    int i;
    ; i < ; i++){

        app_atomic_lock(&);
        value++;
        app_atomic_unlock(&);
    }
    return NULL;
}

int main()
{
    ;

    pthread_t th1, th2;

    pthread_create(&th1, NULL, th_fun, NULL);
    pthread_create(&th2, NULL, th_fun, NULL);

    pthread_join(th1, NULL);
    pthread_join(th2, NULL);

    printf("%d\n", value);
    ;
}

cas在loop抢占的时候,会大量消耗cpu,在x86指令集下,可以用pause指令来减少loop的消耗。

cas锁在极高并发时候,会有非常大的帮助,相反,抢占时间过长,则千万不要用cas无锁。

												

CAS原子锁 高效自旋无锁的正确用法的更多相关文章

  1. JDK1.8 LongAdder 空间换时间: 比AtomicLong还高效的无锁实现

    我们知道,AtomicLong的实现方式是内部有个value 变量,当多线程并发自增,自减时,均通过CAS 指令从机器指令级别操作保证并发的原子性. // setup to use Unsafe.co ...

  2. CAS(Compare and Swap)无锁算法-学习笔记

    非阻塞同步算法与CAS(Compare and Swap)无锁算法 这篇问题对java的CAS讲的非常透彻! 锁的代价 1. 内核态的锁的时候需要操作系统进行一次上下文切换,加锁.释放锁会导致比较多的 ...

  3. 非阻塞同步算法与CAS(Compare and Swap)无锁算法

    锁(lock)的代价 锁是用来做并发最简单的方式,当然其代价也是最高的.内核态的锁的时候需要操作系统进行一次上下文切换,加锁.释放锁会导致比较多的上下文切换和调度延时,等待锁的线程会被挂起直至锁释放. ...

  4. 【Java并发编程】9、非阻塞同步算法与CAS(Compare and Swap)无锁算法

    转自:http://www.cnblogs.com/Mainz/p/3546347.html?utm_source=tuicool&utm_medium=referral 锁(lock)的代价 ...

  5. 【漫画】CAS原理分析!无锁原子类也能解决并发问题!

    本文来源于微信公众号[胖滚猪学编程].转载请注明出处 在漫画并发编程系统博文中,我们讲了N篇关于锁的知识,确实,锁是解决并发问题的万能钥匙,可是并发问题只有锁能解决吗?今天要出场一个大BOSS:CAS ...

  6. 高效C++无锁队列实现-moodycamel::ConcurrentQueue

    国外一牛人做的,支持多平台,支持多线程写.多线程读,并可指定读写token,转载过来. 感觉作者也时刻维护着他这个项目,我提了一些问题,每次都会及时得到答复,而且回复得非常认真仔细,非常赞! 链接地址 ...

  7. java 多线程12 : 无锁 实现CAS原子性操作----原子类

    由于java 多线程11:volatile关键字该文讲道可以使用不带锁的情况也就是无锁使变量变成可见,这里就理解下如何在无锁的情况对线程变量进行CAS原子性及可见性操作 我们知道,在并发的环境下,要实 ...

  8. CAS原子操作实现无锁及性能分析

    CAS原子操作实现无锁及性能分析 Author:Echo Chen(陈斌) Email:chenb19870707@gmail.com Blog:Blog.csdn.net/chen19870707 ...

  9. CAS无锁实现原理以及ABA问题

    CAS(比较与交换,Compare and swap) 是一种有名的无锁算法.无锁编程,即不使用锁的情况下实现多线程之间的变量同步,也就是在没有线程被阻塞的情况下实现变量的同步,所以也叫非阻塞同步(N ...

随机推荐

  1. CSS盒模型

    CSS盒模型是CSS 可视化格式化系统的基石,它是理解样式表如何工作的核心概念.盒模型用于元素定位和页面布局.元素框的最内部分是实际的内容,直接包围内容的是内边距.内边距呈现了元素的背景.内边距的边缘 ...

  2. js获取倒计时

    <html> <head> <title>出错啦~~~</title> <link href="css/login1.css" ...

  3. java覆盖和隐藏

    隐藏指的是子类把父类的属性或者方法隐藏了,即将子类强制转换成父类后,调用的还是父类的属性和方法,而覆盖则指的是父类引用指向了子类对象,调用的时候会调用子类的具体方法. (1) 变量只能被隐藏(包括静态 ...

  4. Refresh recovery area usage data after manually deleting files under recovery area

    Original source: http://www.dba-oracle.com/t_v$_flash_recovery_area.htm If you manually delete files ...

  5. 【转】linux shell实现随机数多种方法(date,random,uuid)

    在日常生活中,随机数实际上经常遇到,想丢骰子,抓阄,还有抽签.呵呵,非常简单就可以实现.那么在做程序设计,真的要通过自己程序设计出随机数那还真的不简单了.现在很多都是操作系统内核会提供相应的api,这 ...

  6. selenium 切换窗口 每次成功code

    最近用了网络上别人的一段切换窗口的code每次成功了,不错,学习 // 根据Title切换新窗口 public boolean switchToWindow_Title(WebDriver drive ...

  7. Linux内核--网络栈实现分析(七)--数据包的传递过程(下)

    本文分析基于Linux Kernel 1.2.13 原创作品,转载请标明http://blog.csdn.net/yming0221/article/details/7545855 更多请查看专栏,地 ...

  8. 《利用Python进行数据分析》第8章学习笔记

    绘图和可视化 matplotlib入门 创建窗口和画布 fig = plt.figure() ax1 = fig.add_subplot(2,2,1) ax2 = fig.add_subplot(2, ...

  9. 《利用Python进行数据分析》第4章学习笔记

    NumPy基础:数组和矢量计算 NumPy的ndarray:一种多维数组对象 该对象是一个快速灵活的大数据集容器.你可以利用这种数组对整块数据执行一些数学运算,其语法跟标量元素之间的运算一样 列表转换 ...

  10. (转载)JAVA敏捷开发环境搭建

    整个软件项目分为四个环境 开发本地环境.开发环境.测试环境.IDC环境.和传统C++开发不一样的模式是多了第一个开发本地环境.这是为什么呢,因为目前大部分开发人员还是比较熟悉windows下开发.对于 ...