源码解析JDK1.8-HashMap链表成环的问题解决方案
前言
上篇文章详解介绍了HashMap在JDK1.7版本中链表成环的原因,今天介绍下JDK1.8针对HashMap线程安全问题的解决方案。
jdk1.8 扩容源码解析
public class HashMap<K,V> extends AbstractMap<K,V>
implements Map<K,V>, Cloneable, Serializable {
// jdk1.8 HashMap扩容源码
final Node<K,V>[] resize() {
Node<K,V>[] oldTab = table;
// 到@SuppressWarnings都是计算newTab的newCap和threshold容量
int oldCap = (oldTab == null) ? 0 : oldTab.length;
int oldThr = threshold;
int newCap, newThr = 0;
if (oldCap > 0) {
if (oldCap >= MAXIMUM_CAPACITY) {
threshold = Integer.MAX_VALUE;
return oldTab;
}
else if ((newCap = oldCap << 1) < MAXIMUM_CAPACITY &&
oldCap >= DEFAULT_INITIAL_CAPACITY)
newThr = oldThr << 1; // double threshold
}
else if (oldThr > 0) // initial capacity was placed in threshold
newCap = oldThr;
else { // zero initial threshold signifies using defaults
newCap = DEFAULT_INITIAL_CAPACITY;
newThr = (int)(DEFAULT_LOAD_FACTOR * DEFAULT_INITIAL_CAPACITY);
}
if (newThr == 0) {
float ft = (float)newCap * loadFactor;
newThr = (newCap < MAXIMUM_CAPACITY && ft < (float)MAXIMUM_CAPACITY ?
(int)ft : Integer.MAX_VALUE);
}
threshold = newThr;
@SuppressWarnings({"rawtypes","unchecked"})
Node<K,V>[] newTab = (Node<K,V>[])new Node[newCap];
// 开始进行数据迁移
table = newTab;
if (oldTab != null) {
// 遍历oldTab中的数据,并迁移到新数组。
for (int j = 0; j < oldCap; ++j) {
Node<K,V> e;
// 如果oldTab数组中j位置数据不为null,进行遍历,并赋值给e,避免直接对oldTab进行操作
if ((e = oldTab[j]) != null) {
oldTab[j] = null;
// 如果oldTab的j位置数据没有形成链表,就直接赋值到newTab
if (e.next == null)
newTab[e.hash & (newCap - 1)] = e;
// 链表转换成了红黑树,针对红黑树的迁移方式
else if (e instanceof TreeNode)
((TreeNode<K,V>)e).split(this, newTab, j, oldCap);
// 针对链表的数据迁移方式
else { // preserve order
// loHead 表示老值,老值的意思是扩容后,该链表中计算出索引位置不变的元素
Node<K,V> loHead = null, loTail = null;
// hiHead 表示新值,新值的意思是扩容后,计算出索引位置发生变化的元素
Node<K,V> hiHead = null, hiTail = null;
Node<K,V> next;
do {
next = e.next;
// 表示老值链表,即该链表中计算出索引位置不变的元素
if ((e.hash & oldCap) == 0) {
if (loTail == null)
loHead = e;
else
loTail.next = e;
loTail = e;
}
// 表示新值链表,即计算出索引位置发生变化的元素
else {
if (hiTail == null)
hiHead = e;
else
hiTail.next = e;
hiTail = e;
}
} while ((e = next) != null);
// 生成链表后整体赋值
// 老链表整体赋值
if (loTail != null) {
loTail.next = null;
newTab[j] = loHead;
}
// 新链表整体赋值
if (hiTail != null) {
hiTail.next = null;
newTab[j + oldCap] = hiHead;
}
}
}
}
}
return newTab;
}
}
看完上边的代码后,可能也是一头雾水,下面我们重点对其中的细节点进行解析,针对计算newTab的newCap和threshold容量部分我们就不详细阐述,重点从数据迁移部分进行分析。我们按照代码顺序分步进行分析。
1、利用for循环遍历oldTab中的数据
for (int j = 0; j < oldCap; ++j) {
Node<K,V> e;
2、对oldTab在j位置的数据进行判断,并进行数据迁移操作
如果在oldTab的j位置数据没有形成链表
if (e.next == null)
newTab[e.hash & (newCap - 1)] = e;
如果e.next == null,也就是e没有next数据节点,通过这种方法判断是否形成了链表数据结构,如果没有形成链表数据结构,直接将数据放到对应newTab的位置即可。
e.hash & (newCap - 1) : 代表newTab存放e数据的位置,假如,e.hash = 5,oldCap = 4(老数组oldTab的长度),newCap = 8(新数组newTab的长度,即老数组2倍扩容),那么该e元素:在oldTab中的位置为:5 & (4 - 1) = 1
101
& 11
001
在newTab中的位置为:5 & (8 - 1) = 5
101
& 111
101

这种计算方式既能保证数据存储散列,又能避免计算出的位置超出最大容量(也就是数组角标越界,因为作&运算,不会超过oldTab-1和newTab-1)。
3、链表转换成了红黑树,针对红黑树的迁移方式
else if (e instanceof TreeNode)
((TreeNode<K,V>)e).split(this, newTab, j, oldCap);
具体的遍历方式赞不做解析,如想了解更多,请关注公众号“程序员清辞”。
4、针对链表的数据迁移方式
else { // preserve order
// loHead 表示老值,老值的意思是扩容后,该链表中计算出索引位置不变的元素
Node<K,V> loHead = null, loTail = null;
// hiHead 表示新值,新值的意思是扩容后,计算出索引位置发生变化的元素
Node<K,V> hiHead = null, hiTail = null;
Node<K,V> next;
do {
next = e.next;
// 表示老值链表,即该链表中计算出索引位置不变的元素
if ((e.hash & oldCap) == 0) {
if (loTail == null)
loHead = e;
else
loTail.next = e;
loTail = e;
}
// 表示新值链表,即计算出索引位置发生变化的元素
else {
if (hiTail == null)
hiHead = e;
else
hiTail.next = e;
hiTail = e;
}
} while ((e = next) != null);
}
jdk1.8版本为了提高链表迁移的效率,引用两个新的概念:
loHead:表示老值,老值的意思是扩容后,该链表中计算出索引位置不变的元素。
hiHead:表示新值,新值的意思是扩容后,计算出索引位置发生变化的元素。
举个例子,数组大小是 8 ,在数组索引位置是 1 的地方挂着一个链表,链表有两个值,两个值的 hashcode 分别是是9和33。当数组发生扩容时,新数组的大小是 16,此时 hashcode 是 33 的值计算出来的数组索引位置仍然是 1,我们称为老值hashcode 是 9 的值计算出来的数组索引位置是 9,就发生了变化,我们称为新值。
针对链表做do-while遍历,条件为(e = next) != null。利用(e.hash & oldCap) == 0来判断元素e属于新值链表还是老值链表。参考上面索引位置计算算法 e.hash & (oldCap - 1),这次直接利用e.hash与oldCap作&运算,因为oldCap为4、8、16...为2的指数,其二进制为100,1000,10000....,所以e.hash与其作&运算,假如oldCap = 4,newCap = 8,那么最终计算得到的值如果等于0,则该元素的位置0~3之间,除此之外在4~7之间。通过这种方式判断元素e属于老值还是新值,这样生成两条新的链表。
5、生成新老链表后整体赋值
// 老链表整体赋值
if (loTail != null) {
loTail.next = null;
newTab[j] = loHead;
}
// 新链表整体赋值
if (hiTail != null) {
hiTail.next = null;
newTab[j + oldCap] = hiHead;
}
如果是老链表,直接将数据赋值给newTab[j]。如果是新链表,需要进行将j增加oldCap的长度,通过e.hash & (newTab - 1)计算后得到的也是这个值。计算原理是相通的。
总结:
jdk1.8 是等链表整个 while 循环结束后,才给数组赋值,此时使用局部变量 loHead 和 hiHead 来保存链表的值,因为是局部变量,所以多线程的情况下,肯定是没有问题的。
为什么有 loHead 和 hiHead 两个新老值来保存链表呢,主要是因为扩容后,链表中的元素的索引位置是可能发生变化的。
源码解析JDK1.8-HashMap链表成环的问题解决方案的更多相关文章
- Java集合-ArrayList源码解析-JDK1.8
◆ ArrayList简介 ◆ ArrayList 是一个数组队列,相当于 动态数组.与Java中的数组相比,它的容量能动态增长.它继承于AbstractList,实现了List, RandomAcc ...
- ArrayList、CopyOnWriteArrayList源码解析(JDK1.8)
本篇文章主要是学习后的知识记录,存在不足,或许不够深入,还请谅解. 目录 ArrayList源码解析 ArrayList中的变量 ArrayList构造函数 ArrayList中的add方法 Arra ...
- Map集合类(一.hashMap源码解析jdk1.8)
java集合笔记一 java集合笔记二 java集合笔记三 jdk 8 之前,其内部是由数组+链表来实现的,而 jdk 8 对于链表长度超过 8 的链表将转储为红黑树 1.属性 //节点数组,第一次使 ...
- 多目标遗传算法 ------ NSGA-II (部分源码解析)辅助变量 双链表操作 list.c
/* A custom doubly linked list implemenation */ # include <stdio.h> # include <stdlib.h> ...
- ArrayList源码分析--jdk1.8
ArrayList概述 1. ArrayList是可以动态扩容和动态删除冗余容量的索引序列,基于数组实现的集合. 2. ArrayList支持随机访问.克隆.序列化,元素有序且可以重复. 3. ...
- ReentrantLock源码分析--jdk1.8
JDK1.8 ArrayList源码分析--jdk1.8LinkedList源码分析--jdk1.8HashMap源码分析--jdk1.8AQS源码分析--jdk1.8ReentrantLock源码分 ...
- jdk1.8源码解析:HashMap底层数据结构之链表转红黑树的具体时机
本文从三个部分去探究HashMap的链表转红黑树的具体时机: 一.从HashMap中有关“链表转红黑树”阈值的声明: 二.[重点]解析HashMap.put(K key, V value)的源码: 三 ...
- 给jdk写注释系列之jdk1.6容器(4)-HashMap源码解析
前面了解了jdk容器中的两种List,回忆一下怎么从list中取值(也就是做查询),是通过index索引位置对不对,由于存入list的元素时安装插入顺序存储的,所以index索引也就是插入的次序. M ...
- Java集合类源码解析:HashMap (基于JDK1.8)
目录 前言 HashMap的数据结构 深入源码 两个参数 成员变量 四个构造方法 插入数据的方法:put() 哈希函数:hash() 动态扩容:resize() 节点树化.红黑树的拆分 节点树化 红黑 ...
随机推荐
- Python编程入门(第3版)|百度网盘免费下载|零基础入门学习资料
百度网盘免费下载:Python编程入门(第3版) 提取码:rsd7 目录 · · · · · · 第1章 编程简介 11.1 Python语言 21.2 Python适合用于做什么 31.3 程序员 ...
- Python Python Python 100个练手项目
1.淘宝模拟登录2.天猫商品数据爬虫3.爬取淘宝我已购买的宝贝数据4.每天不同时间段通过微信发消息提醒女友5.爬取5K分辨率超清唯美壁纸6.爬取豆瓣排行榜电影数据(含GUI界面版)7.多线程+代理池爬 ...
- 前端学习(十七):JavaScript常用对象
进击のpython ***** 前端学习--JavaScript常用对象 JavaScript中的所有事物都是对象:字符串.数字.数组.日期,等等 在JavaScript中,对象是拥有属性和方法的数据 ...
- I Hate It(区间最大问题,线段树)
很多学校流行一种比较的习惯.老师们很喜欢询问,从某某到某某当中,分数最高的是多少.这让很多学生很反感. 不管你喜不喜欢,现在需要你做的是,就是按照老师的要求,写一个程序,模拟老师的询问.当然,老师有时 ...
- It还是高薪行业不?—软件测试
It还是高薪行业不?—软件测试 谁都希望拿高薪,但是并不是所有人.所有地方都能的:甚者培训出来还不能就业的大有人在,也不是所有人都适合培训后就业(年龄.学历.专业.期望就业地点.不同行业转行还是有很大 ...
- CF R 632 div2 1333D Challenges in school №41
LINK:Challenges in school №41 考试的时候读错题了+代码UB了 所以wa到自闭 然后放弃治疗. 赛后发现UB的原因是 scanf读int类型的时候 宏定义里面是lld的类型 ...
- Windows环境编译Spark源码
一.下载源码包 1. 下载地址有官网和github: http://spark.apache.org/downloads.html https://github.com/apache/spark Li ...
- python 爬虫刷访问量
import urllib.requestimport time # 使用build_opener()是为了让python程序模仿浏览器进行访问opener = urllib.request.buil ...
- python8.3多进程
from multiprocessing import Processimport time def run1 (name,sex): print(name,sex,"执行进程1" ...
- 嵌入式linux下获取flash分区大小
在嵌入式系统中,由于flash存储空间有限,或者是存储数据,实现数据的循环删除,需要获取到分区的使用情况,可以通过系统下的函数statfs来获取使用情况:实现代码如下: flashInfo.cpp # ...