文档章节

推荐:并发情况下:Java HashMap 形成死循环的原因

码代码的小司机
 码代码的小司机
发布于 06/19 23:26
字数 1696
阅读 46
收藏 38
点赞 0
评论 3

在淘宝内网里看到同事发了贴说了一个CPU被100%的线上故障,并且这个事发生了很多次,原因是在Java语言在并发情况下使用HashMap造成Race Condition,从而导致死循环。这个事情我4、5年前也经历过,本来觉得没什么好写的,因为Java的HashMap是非线程安全的,所以在并发下必然出现问题。但是,我发现近几年,很多人都经历过这个事(在网上查“HashMap Infinite Loop”可以看到很多人都在说这个事)所以,觉得这个是个普遍问题,需要写篇疫苗文章说一下这个事,并且给大家看看一个完美的“Race Condition”是怎么形成的。

问题的症状

从前我们的Java代码因为一些原因使用了HashMap这个东西,但是当时的程序是单线程的,一切都没有问题。后来,我们的程序性能有问题,所以需要变成多线程的,于是,变成多线程后到了线上,发现程序经常占了100%的CPU,查看堆栈,你会发现程序都Hang在了HashMap.get()这个方法上了,重启程序后问题消失。但是过段时间又会来。而且,这个问题在测试环境里可能很难重现。

我们简单的看一下我们自己的代码,我们就知道HashMap被多个线程操作。而Java的文档说HashMap是非线程安全的,应该用ConcurrentHashMap。

但是在这里我们可以来研究一下原因:

主要是多线程同时put时,如果同时触发了rehash操作,会导致HashMap中的链表中出现循环节点,进而使得后面get的时候,会死循环。

 

 

Hash表数据结构

我需要简单地说一下HashMap这个经典的数据结构

HashMap通常会用一个指针数组(假设为table[])来做分散所有的key,当一个key被加入时,会通过Hash算法通过key算出这个数组的下标i,然后就把这个<key, value>插到table[i]中,如果有两个不同的key被算在了同一个i,那么就叫冲突,又叫碰撞,这样会在table[i]上形成一个链表。

我们知道,如果table[]的尺寸很小,比如只有2个,如果要放进10个keys的话,那么碰撞非常频繁,于是一个O(1)的查找算法,就变成了链表遍历,性能变成了O(n),这是Hash表的缺陷(可参看《Hash Collision DoS 问题》)。

所以,Hash表的尺寸和容量非常的重要。一般来说,Hash表这个容器当有数据要插入时,都会检查容量有没有超过设定的thredhold,如果超过,需要增大Hash表的尺寸,但是这样一来,整个Hash表里的无素都需要被重算一遍。这叫rehash,这个成本相当的大。

相信大家对这个基础知识已经很熟悉了。

HashMap的rehash源代码

下面,我们来看一下Java的HashMap的源代码。

Put一个Key,Value对到Hash表中:

 

[java] view plain copy

  1. public V put(K key, V value)  
  2. {  
  3.     ......  
  4.     //算Hash值  
  5.     int hash = hash(key.hashCode());  
  6.     int i = indexFor(hash, table.length);  
  7.     //如果该key已被插入,则替换掉旧的value (链接操作)  
  8.     for (Entry<K,V> e = table[i]; e != null; e = e.next) {  
  9.         Object k;  
  10.         if (e.hash == hash && ((k = e.key) == key || key.equals(k))) {  
  11.             V oldValue = e.value;  
  12.             e.value = value;  
  13.             e.recordAccess(this);  
  14.             return oldValue;  
  15.         }  
  16.     }  
  17.     modCount++;  
  18.     //该key不存在,需要增加一个结点  
  19.     addEntry(hash, key, value, i);  
  20.     return null;  
  21. }  

检查容量是否超标

 

 

[java] view plain copy

  1. void addEntry(int hash, K key, V value, int bucketIndex)  
  2. {  
  3.     Entry<K,V> e = table[bucketIndex];  
  4.     table[bucketIndex] = new Entry<K,V>(hash, key, value, e);  
  5.     //查看当前的size是否超过了我们设定的阈值threshold,如果超过,需要resize  
  6.     if (size++ >= threshold)  
  7.         resize(2 * table.length);  
  8. }  


新建一个更大尺寸的hash表,然后把数据从老的Hash表中迁移到新的Hash表中。

 

 

[java] view plain copy

  1. void resize(int newCapacity)  
  2. {  
  3.     Entry[] oldTable = table;  
  4.     int oldCapacity = oldTable.length;  
  5.     ......  
  6.     //创建一个新的Hash Table  
  7.     Entry[] newTable = new Entry[newCapacity];  
  8.     //将Old Hash Table上的数据迁移到New Hash Table上  
  9.     transfer(newTable);  
  10.     table = newTable;  
  11.     threshold = (int)(newCapacity * loadFactor);  
  12. }  


迁移的源代码,注意高亮处:

 

 

[java] view plain copy

  1. void transfer(Entry[] newTable)  
  2. {  
  3.     Entry[] src = table;  
  4.     int newCapacity = newTable.length;  
  5.     //下面这段代码的意思是:  
  6.     //  从OldTable里摘一个元素出来,然后放到NewTable中  
  7.     for (int j = 0; j < src.length; j++) {  
  8.         Entry<K,V> e = src[j];  
  9.         if (e != null) {  
  10.             src[j] = null;  
  11.             do {  
  12.                 Entry<K,V> next = e.next;  
  13.                 int i = indexFor(e.hash, newCapacity);  
  14.                 e.next = newTable[i];  
  15.                 newTable[i] = e;  
  16.                 e = next;  
  17.             } while (e != null);  
  18.         }  
  19.     }  
  20. }  

 

好了,这个代码算是比较正常的。而且没有什么问题。

正常的ReHash的过程

画了个图做了个演示。

  • 我假设了我们的hash算法就是简单的用key mod 一下表的大小(也就是数组的长度)。
  • 最上面的是old hash 表,其中的Hash表的size=2, 所以key = 3, 7, 5,在mod 2以后都冲突在table[1]这里了。
  • 接下来的三个步骤是Hash表 resize成4,然后所有的<key,value> 重新rehash的过程

并发下的Rehash

1)假设我们有两个线程。我用红色和浅蓝色标注了一下。

我们再回头看一下我们的 transfer代码中的这个细节:

 

[java] view plain copy

  1. do {  
  2.     Entry<K,V> next = e.next; // <--假设线程一执行到这里就被调度挂起了  
  3.     int i = indexFor(e.hash, newCapacity);  
  4.     e.next = newTable[i];  
  5.     newTable[i] = e;  
  6.     e = next;  
  7. } while (e != null);  

 

而我们的线程二执行完成了。于是我们有下面的这个样子。

注意,因为Thread1的 e 指向了key(3),而next指向了key(7),其在线程二rehash后,指向了线程二重组后的链表。我们可以看到链表的顺序被反转后。

2)线程一被调度回来执行。

  • 先是执行 newTalbe[i] = e;
  • 然后是e = next,导致了e指向了key(7),
  • 而下一次循环的next = e.next导致了next指向了key(3)

3)一切安好。

线程一接着工作。把key(7)摘下来,放到newTable[i]的第一个,然后把e和next往下移

4)环形链接出现。

e.next = newTable[i] 导致  key(3).next 指向了 key(7)

注意:此时的key(7).next 已经指向了key(3), 环形链表就这样出现了。

于是,当我们的线程一调用到,HashTable.get(11)时,悲剧就出现了——Infinite Loop。

其它

有人把这个问题报给了Sun,不过Sun不认为这个是一个问题。因为HashMap本来就不支持并发。要并发就用ConcurrentHashmap

http://bugs.sun.com/bugdatabase/view_bug.do?bug_id=6423457

我在这里把这个事情记录下来,只是为了让大家了解并体会一下并发环境下的危险。

参考:http://mailinator.blogspot.com/2009/06/beautiful-race-condition.html

本文转载自:

共有 人打赏支持
码代码的小司机
粉丝 21
博文 74
码字总数 41277
作品 0
杭州
高级程序员
加载中

评论(3)

码代码的小司机
码代码的小司机
@NickYoung 这篇文章是转载的,转载出来的原因是自己学习之后的总结
NickYoung
NickYoung

引用来自“爱吃窝窝头”的评论

并发还用hashmap,真是没事找事,这种文章还发,有意思?

@爱吃窝窝头 同意你的看法,虽然我也是阿里的,改为多线程并发业务,就不该用非线程安全集合,遇到这种问题显然还不算严重事故,看来当时这位老哥没有考虑到这些隐患,楼主这个问题分析的很不错,重温了下1.7,1.8加入了过8转为红黑树哦
爱吃窝窝头
爱吃窝窝头
并发还用hashmap,真是没事找事,这种文章还发,有意思?
HashMap多线程下死循环的坑记录

PS:不得不说Java编程思想这本书是真心强大.. 学习内容: 1.HashMap<K,V>在多线程的情况下出现的死循环现象 当初学Java的时候只是知道HashMap<K,V>在并发的情况下使用的话,会出现线程安全问题...

java_龙
01/03
0
0
Java HashMap的死循环

在淘宝内网里看到同事发了贴说了一个 CPU 被 100% 的线上故障,并且这个事发生了很多次,原因是在 Java 语言在并发情况下使用 HashMap 造成 Race Condition,从而导致死循环。这个事情我4、5...

杭州_周陶忠
2013/09/11
0
0
☆HashMap多线程并发问题分析

从前我们的Java代码因为一些原因使用了HashMap这个东西,但是当时的程序是单线程的,一切都没有问题。后来,我们的程序性能有问题,所以需要变成多线程的,于是,变成多线程后到了线上,发现...

陶邦仁
2015/03/31
0
5
HashMap--并发下死循环(HashMap不能在多线程下使用)

在淘宝内网里看到同事发了贴说了一个CPU被100%的线上故障,并且这个事发生了很多次,原因是在Java语言在并发情况下使用HashMap造 成Race Condition,从而导致死循环。这个事情我4、5年前也经...

只想一个人静一静
2014/03/05
0
0
记几次JAVA系统故障问题定位过程

把自己以前碰到的case汇总列下,作为对自己过去的一部分工作总结。 问题定位一般步骤 具备常见的理论知识,不一定要全记住细节。但是需要知道问题的关联性,然后根据某些关键字搜索或者查阅资...

geecoodeer
2014/01/27
0
5
Java HashMap的死循环

在淘宝内网里看到同事发了贴说了一个CPU被100%的线上故障,并且这个事发生了很多次,原因是在Java语言在并发情况下使用HashMap造成Race Condition,从而导致死循环。这个事情我4、5年前也经历...

gongweixin
2013/08/19
0
6
手把手带你源码分析 HashMap 1.7

前言 HashMap 在 Java 和 Android 开发中非常常见 今天,我将带来 HashMap 的全部源码分析,希望你们会喜欢。 目录 1. 简介 类定义 3. 具体使用 3.1 主要使用API(方法、函数) 3.2 使用流程...

烂猪皮
04/21
0
0
Java程序员面试大纲—错过了金三银四,你还要错过2018吗?

跳槽时时刻刻都在发生,但是我建议大家跳槽之前,先想清楚为什么要跳槽。切不可跟风,看到同事一个个都走了,自己也盲目的开始面试起来(期间也没有准备充分),到底是因为技术原因(影响自己...

java高级架构牛人
04/27
0
0
Java 50道Java线程面试题

不管你是新程序员还是老手,你一定在面试中遇到过有关线程的问题。Java语言一个重要的特点就是内置了对并发的支持,让Java大受企业和程序员的欢迎。大多数待遇丰厚的Java开发职位都要求开发者...

swearyd457
2015/08/11
0
0
【转】Java线程面试题Top50

目录(?)[-] 50道Java线程面试题 1 什么是线程 2 线程和进程有什么区别 3 如何在Java中实现线程 4 用Runnable还是Thread 6 Thread 类中的start 和 run 方法有什么区别 7 Java中Runnable和Cal...

gehui
2015/08/14
0
0

没有更多内容

加载失败,请刷新页面

加载更多

下一页

ClassNotFoundException: javax.el.ELManager

这个是因为tomcat7中的el-api2.2,有些版本太低,建议升级tomcat到8.0,利用el-api3.0就会解决这个问题。

无语年华
6分钟前
0
0
Jvm堆内存的划分结构和优化,垃圾回收详解(详细解答篇)

在JVM中堆空间划分如下图所示 上图中,刻画了Java程序运行时的堆空间,可以简述成如下2条 1.JVM中堆空间可以分成三个大区,新生代、老年代、永久代 2.新生代可以划分为三个区,Eden区,两个幸...

嘻哈开发者
18分钟前
0
0
CentOS 7.4 设置系统字符编码

1.语言变量LANG在 /etc/locale 文件中。 2.可以通过/ect/profile 来修改LC_TYPE 变量的值 添加如下代码 export LC_ALL="zh_CN.GBK" export LANG="zh_CN.GBK" 到profile文件中,变量的可以修改...

qimh
19分钟前
0
0
Kafka相关使用

安装前提,需要有jdk环境,还有zookeeper环境 zookeeper下载地址:https://www.apache.org/dyn/closer.cgi/zookeeper/ zookeeper安装参考:https://www.jianshu.com/p/f7037105db46 kafka的下......

朝如青丝暮成雪
20分钟前
0
0
CentOS7 解决无法使用tab自动补全 tab代码提示

一、前言 对于刚刚开始学习linux的新人来说,linux的一切都显着神秘,只能惊叹于大牛在Linux上行云流水的操作。今天介绍一下在linux中自动补全的功能。 对于新人来说,在不懂得技巧的情况下,...

ziluopao
26分钟前
0
0
redis安装

https://www.cnblogs.com/feijl/p/6879929.html

ghou-靠墙哭
26分钟前
0
0
Spring核心——注解自动装载

从配置上扩展 之前的文章介绍了Spring的IoC容器配置管理方面的详细内容,需要了解的可以从IoC容器的设计模式开始阅读。在介绍基于注解配置的配置之前我们再重复一下在之前提到的基本认识: ...

随风溜达的向日葵
29分钟前
2
0
ElasticSearch学习(8)—— SearchType

Elasticsearch有四种类型的SearchType 1、query and fetch 向索引的所有分片(shard)都发出查询请求,各分片返回的时候把元素文档(document)和计算后的排名信息一起返回。这种搜索方式是最...

叶枫啦啦
31分钟前
0
0
MYSQL备份工具-mysqldump

介绍 mysqldump 是文本备份还是二进制备份 它是文本备份,如果你打开备份文件你将看到所有的语句,可以用于重新创建表和对象。它也有 insert 语句来使用数据构成表。 语法 mysqldump 的语法是...

郭恩洲_OSC博客
32分钟前
0
0
我的第一个go web框架

使用了beego等go web开发框架之后,感觉各种不方便,尤其是在接收参数、和自定义输出的时候,各种难受,定义各种model,这不是找事情嘛??尤其是在角色权限控制的时候我也感觉力不从心。。。...

独坐苔痕但观罗敷
33分钟前
0
0

没有更多内容

加载失败,请刷新页面

加载更多

下一页

返回顶部
顶部