Go语言 WaitGroup 详解
你必须非常努力,才能看起来毫不费力!
微信搜索公众号[ 漫漫Coding路 ],一起From Zero To Hero !
前言
在前面的文章中,我们使用过 WaitGroup
进行任务编排,Go语言中的 WaitGroup
和 Java 中的 CyclicBarrier
、CountDownLatch
非常类似。比如我们有一个主任务在执行,执行到某一点时需要并行执行三个子任务,并且需要等到三个子任务都执行完后,再继续执行主任务。那我们就需要设置一个检查点,使主任务一直阻塞在这,等三个子任务执行完后再放行。
说明:本文中的示例,均是基于Go1.17 64位机器
小试牛刀
我们先来个简单的例子,看下 WaitGroup
是怎么使用的。示例中使用 Add(5)
表示我们有 5个 子任务,然后起了 5个 协程去完成任务,主协程使用 Wait()
方法等待 子协程执行完毕,输出一共等待的时间。
func main() {
var waitGroup sync.WaitGroup
start := time.Now()
waitGroup.Add(5)
for i := 0; i < 5; i++ {
go func() {
defer waitGroup.Done()
time.Sleep(time.Second)
fmt.Println("done")
}()
}
waitGroup.Wait()
fmt.Println(time.Now().Sub(start).Seconds())
}
/*
done
done
done
done
done
1.000306089
*/
总览
WaitGroup 一共有三个方法:
(wg *WaitGroup) Add(delta int)
(wg *WaitGroup) Done()
(wg *WaitGroup) Wait()
Add
方法用于设置 WaitGroup 的计数值,可以理解为子任务的数量Done
方法用于将 WaitGroup 的计数值减一,可以理解为完成一个子任务Wait
方法用于阻塞调用者,直到 WaitGroup 的计数值为0,即所有子任务都完成
正常来说,我们使用的时候,需要先确定子任务的数量,然后调用 Add() 方法传入相应的数量,在每个子任务的协程中,调用 Done(),需要等待的协程调用 Wait() 方法,状态流转如下图:
底层实现
结构体
type WaitGroup struct {
noCopy noCopy // noCopy 字段标识,由于 WaitGroup 不能复制,方便工具检测
state1 [3]uint32 // 12个字节,8个字节标识 计数值和等待数量,4个字节用于标识信号量
}
state1
是个复合字段,会拆分为两部分: 64位
(8个字节)的 statep
作为一个整体用于原子操作, 其中前面4个字节表示计数值,后面四个字节表示等待数量;剩余 32位
(4个字节)semap
用于标识信号量。
Go语言中对于64位的变量进行原子操作,需要保证该变量是 64位对齐
的,也就是要保证这 8个字节 的首地址是 8 的整数倍。因此当 state1
的首地址是 8 的整数倍时,取前8个
字节作为 statep
,后4个
字节作为 semap
;当 state1
的首地址不是 8 的整数倍时,取后8个
字节作为 statep
,前4个
字节作为 semap
。
func (wg *WaitGroup) state() (statep *uint64, semap *uint32) {
// 首地址是8的倍数时,前8个字节为 statep, 后四个字节为 semap
if uintptr(unsafe.Pointer(&wg.state1))%8 == 0 {
return (*uint64)(unsafe.Pointer(&wg.state1)), &wg.state1[2]
} else {
// 后8个字节为 statep, 前四个字节为 semap
return (*uint64)(unsafe.Pointer(&wg.state1[1])), &wg.state1[0]
}
}
Add
Add
方法用于添加一个计数值(负数相当于减),当计数值变为0后,Wait
方法阻塞的所有等待者都会被释放- 计数值变为负数是非法操作,产生
panic
- 当计数值为0时(初始状态),
Add
方法不能和Wait
方法并发调用,需要保证Add
方法在Wait
方法之前
调用,否则会panic
func (wg *WaitGroup) Add(delta int) {
// 拿到计数值等待者变量 statep 和 信号量 semap
statep, semap := wg.state()
// 计数值加上 delta: statep 的前四个字节是计数值,因此将 delta 前移 32位
state := atomic.AddUint64(statep, uint64(delta)<<32)
// 计数值
v := int32(state >> 32)
// 等待者数量
w := uint32(state)
// 如果加上 delta 之后,计数值变为负数,不合法,panic
if v < 0 {
panic("sync: negative WaitGroup counter")
}
// delta > 0 && v == int32(delta) : 表示从 0 开始添加计数值
// w!=0 :表示已经有了等待者
// 说明在添加计数值的时候,同时添加了等待者,非法操作。添加等待者需要在添加计数值之后
if w != 0 && delta > 0 && v == int32(delta) {
panic("sync: WaitGroup misuse: Add called concurrently with Wait")
}
// v>0 : 计数值不等于0,不需要唤醒等待者,直接返回
// w==0: 没有等待者,不需要唤醒,直接返回
if v > 0 || w == 0 {
return
}
// 再次检查数据是否一致
if *statep != state {
panic("sync: WaitGroup misuse: Add called concurrently with Wait")
}
// 到这里说明计数值为0,且等待者大于0,需要唤醒所有的等待者,并把系统置为初始状态(0状态)
// 将计数值和等待者数量都置为0
*statep = 0
// 唤醒等待者
for ; w != 0; w-- {
runtime_Semrelease(semap, false, 0)
}
}
Done
// 完成一个任务,将计数值减一,当计数值减为0时,需要唤醒所有的等待者
func (wg *WaitGroup) Done() {
wg.Add(-1)
}
Wait
// 调用 Wait 方法会被阻塞,直到 计数值 变为0
func (wg *WaitGroup) Wait() {
// 获取计数、等待数和信号量
statep, semap := wg.state()
for {
state := atomic.LoadUint64(statep)
// 计数值
v := int32(state >> 32)
// 等待者数量
w := uint32(state)
// 计数值数量为0,直接返回,无需等待
if v == 0 {
return
}
// 到这里说明计数值数量大于0
// 增加等待者数量:这里会有竞争,比如多个 Wait 调用,或者在同时调用 Add 方法,增加不成功会继续 for 循环
if atomic.CompareAndSwapUint64(statep, state, state+1) {
// 增加成功后,阻塞在信号量这里,等待被唤醒
runtime_Semacquire(semap)
// 被唤醒的时候,应该是0状态。如果重用 WaitGroup,需要等 Wait 返回
if *statep != 0 {
panic("sync: WaitGroup is reused before previous Wait has returned")
}
return
}
}
}
易错点
上面分析源码可以看到几个会产生 panic
的点,这也是我们使用 WaitGroup
需要注意的地方
- 计数值变为负数
- 调用 Add 时参数值传负数
func main() {
var wg sync.WaitGroup
wg.Add(1)
wg.Add(-1)
wg.Add(-1)
}
- 多次调用 Done 方法
func main() {
var wg sync.WaitGroup
wg.Add(1)
go func() {
fmt.Println("test")
wg.Done()
wg.Done()
}()
time.Sleep(time.Second)
wg.Wait()
}
Add 和 Wait 并发调用
Add
和Wait
并发调用,有可能达不到我们预期的效果,甚至panic
。如下示例中,我们想要等待 3 个子任务都执行完后再执行主任务,但实际情况可能是子任务还没起来,主任务就继续往下执行了。
func doSomething(wg *sync.WaitGroup) {
wg.Add(1)
fmt.Println("do something")
defer wg.Done()
}
func main() {
var wg sync.WaitGroup
for i := 0; i < 3; i++ {
go doSomething(&wg)
}
wg.Wait()
fmt.Println("main")
}
//main
//do something
//do something
正确的使用方式,应该是在调用 Wait
前先调用 Add
func doSomething(wg *sync.WaitGroup) {
defer wg.Done()
fmt.Println("do something")
}
func main() {
var wg sync.WaitGroup
wg.Add(3)
for i := 0; i < 3; i++ {
go doSomething(&wg)
}
wg.Wait()
fmt.Println("main")
}
//do something
//do something
//do something
//main
- 没有等 Wait 返回,就重用 WaitGroup
func main() {
var wg sync.WaitGroup
wg.Add(1)
go func() {
fmt.Println("do something")
wg.Done()
wg.Add(1)
}()
wg.Wait()
}
- 复制使用
我们知道 Go 语言中的参数传递,都是值传递,就会产生复制操作。因此在向函数传递 WaitGroup 时,使用指针
进行操作。
// 错误使用方式,没有使用指针
func doSomething(wg sync.WaitGroup) {
fmt.Println("do something")
defer wg.Done()
}
func main() {
var wg sync.WaitGroup
wg.Add(3)
for i := 0; i < 3; i++ {
// 这里没使用指针,wg状态一直不会改变,导致 Wait 一直阻塞
go doSomething(wg)
}
wg.Wait()
fmt.Println("main")
}
总结
本篇文章,我们通过源码+示例的方式,一起学习了 sync.WaitGroup
实现逻辑,同时也给出了一些注意点,只要做到如下操作,就不会出现问题:
- 保证 Add 在 Wait 前调用
- Add 中不传递负数
- 任务完成后不要忘记调用 Done 方法,建议使用 defer wg.Done()
- 不要复制使用 WaitGroup,函数传递时使用指针传递
- 尽量不复用 WaigGroup,减少出问题的风险
更多
个人博客: https://lifelmy.github.io/
微信公众号:漫漫Coding路
Go语言 WaitGroup 详解的更多相关文章
- 深入理解C语言 - 指针详解
一.什么是指针 C语言里,变量存放在内存中,而内存其实就是一组有序字节组成的数组,每个字节有唯一的内存地址.CPU 通过内存寻址对存储在内存中的某个指定数据对象的地址进行定位.这里,数据对象是指存储在 ...
- c++、Java、python对应的编译型语言和解释性语言区别详解
1.首先明确一点: 高级语言是不能直接在CPU上运行的.CPU只能处理机器语言,就是黑客帝国里面那个10101010101110的数字流. 那么为了让机器语言能够在CPU上运行,那么就必须将其变成机器 ...
- C语言指针详解
前言 这不是我第一次写关于C指针的文章了,只是因为指针对于C来说太重要,而且随着自己编程经历越多,对指针的理解越多,因此有了本文. 为什么需要指针? 指针解决了一些编程中基本的问题. 第一,指针的使用 ...
- 小程序脚本语言WXS详解
WXS脚本语言是 Weixin Script脚本的简称,是JS.JSON.WXML.WXSS之后又一大小程序内部文件类型.截至到目前小程序已经提供了5种文件类型. 解构小程序的几种方式,其中一种方式就 ...
- C语言正则表达式详解 regcomp() regexec() regfree()详解
标准的C和C++都不支持正则表达式,但有一些函数库可以辅助C/C++程序员完成这一功能,其中最著名的当数Philip Hazel的Perl-Compatible Regular Expression库 ...
- Canny边缘检测算法原理及C语言实现详解
Canny算子是John Canny在1986年提出的,那年老大爷才28岁,该文章发表在PAMI顶级期刊上的(1986. A computational approach to edge detect ...
- Go语言interface详解
interface Go语言里面设计最精妙的应该算interface,它让面向对象,内容组织实现非常的方便,当你看完这一章,你就会被interface的巧妙设计所折服. 什么是interface 简单 ...
- C语言关键字详解
相对于其他语言来说,C语言的关键字算是少的了.在C98中关键子总共只有32个,我们来分析一下每个关键字在C语言中它独特的作用. 1.关于数据类型的关键字 (1) char :声明字符型变量或函数 ( ...
- C语言typeof详解 offsetof
http://blog.chinaunix.net/uid-28458801-id-4200573.html 前言: typeof关键字是C语言中的一个新扩展,这个特性在linux内核中应用非常 ...
随机推荐
- SpringCloud 简介
目录 什么是微服务? 初识 SpringCloud SpringCloud VS Dubbo 什么是微服务? <互联网系统架构演变> "微服务"一词源于 Martin ...
- 【clickhouse专栏】数据库、数据仓库之间的区别与联系
从本篇文章开始,笔者打算写一个系列的<clickhouse专栏>,其全称是Click Stream,Data WareHouse,简称ClickHouse.从其全称中的"Data ...
- MySQL - 锁的分类
MySQL - 锁的分类 1. 加锁机制 乐观锁 悲观锁 2. 兼容性 共享锁 排他锁 3. 锁粒度 表锁 页锁 行锁 4. 锁模式 记录锁(record-lock) 间隙锁(gap-lock) ne ...
- Nginx安装及支持https代理配置和禁用TSLv1.0、TSLv1.1配置
Linux安装Nginx Nginx安装及支持https代理配置和禁用TSLv1.0.TSLv1.1配置. 下载安装包 [root@localhost ~]# wget http://nginx.or ...
- JS:条件语句2
1.for循环:循环代码块一定的次数 例: for(var i = 0;i<5;i++){ console.log(i); } // 0 1 2 3 4 遍历对象: var arr=[" ...
- TypeScript(7)泛型
泛型 指在定义函数.接口或类的时候,不预先指定具体的类型,而在使用的时候再指定具体类型的一种特性. 引入 下面创建一个函数, 实现功能: 根据指定的数量 count 和数据 value , 创建一个包 ...
- SAP Web Dynpro-使用服务调用
创建服务调用后,功能模块可用于组件. 现在可以选择一个视图,以便在浏览器中显示数据库表的元素. 如果全局控制器不是组件控制器,则必须为所选视图的控制器输入全局控制器的使用页面. 之后,应该有该节点的映 ...
- UiPath官方视频Level2
[UiPath官方视频Level2]Lesson Orchestrator-第5部分 https://www.bilibili.com/video/av81414017 [UiPath官方视频Leve ...
- Kafka KRaft模式探索
1.概述 Kafka是一种高吞吐量的分布式发布订阅消息系统,它可以处理消费者在网站中的所有动作流数据.其核心组件包含Producer.Broker.Consumer,以及依赖的Zookeeper集群. ...
- git的基本操作命令和码云的注册使用
Git文件操作文件的四种状态版本控制就是对文件的版本控制,要对文件进行修改.提交等操作,首先要知道文件当前在什么状态,不然可能会提交了现在还不想提交的文件,或者要提交的文件没提交上. Untracke ...