JVM垃圾收集器

最新推荐文章于 2024-03-20 13:39:50 发布

原创最新推荐文章于 2024-03-20 13:39:50 发布 · 119 阅读

0 ·

CC 4.0 BY-SA版权

文章标签：

#JVM垃圾收集器

JVM 专栏收录该内容

10 篇文章

订阅专栏

本文介绍了HotSpot的算法实现，包括枚举根节点、安全点和安全区域。还详细阐述了多种JVM垃圾收集器，如Serial、ParNew、Parallel Scavenge等，分析了它们的特点、适用场景及优缺点，最后对垃圾收集器参数进行了总结。

摘要生成于 C知道，由 DeepSeek-R1 满血版支持，前往体验 >

1、HotSpot的算法实现。

1.1、枚举根节点。如果虚拟机要全局进行检查引用，会消耗大量的时间。可达性分析进行时还要进行GC停顿。可达性分析必须要保证在一致性的快照中进行，一致性是指在整个分析期间整个执行系统看起来就像被冻结在某个时间节点上，不可以出现分析过程中对象引用还在不断的发生变化的情况。这点是导致GC进行时必须停顿所有的Java执行线程（Stop The World）。当所有线程都停顿之后，虚拟机不会进行全局扫描检查来判断哪些地方存在引用，而是使用一组成为OopMap的数据结构来存储所有的引用，在类加载完成时和编译完成时虚拟机已经知道那些地方存在引用，然后在进行扫描时直接就会存储到OopMap中。

1.2、安全点。虚拟机不会为每条指令生成OopMap，只是在特定的位置记录这些信息，这些位置称为安全点，即程序执行时不会在所有的位置都能停顿下来开始GC，只有在到达安全点时才进行GC停顿。安全点的选定是以程序"是否具有让程序长时间执行的特征"为标准进行选定。长时间执行的最明显特征就是指令序列复用，如方法调用、循环跳转、异常跳转等。

1.2.1、对于安全点，需要考虑的另一个问题就是如何如何在GC发生时让所有线程都跑到最近的安全点上再停顿下来？一是抢先式中断，二是主动式中断。抢先式中断时首先让所有的线程全部中断，如果发现中断的线程没有在安全点，就恢复线程让其跑到安全点再中断。主动式中断是设置一个标志位，让所有的线程去轮询这个标志，当标志位为true时，就中断挂起线程，标志位的设置点和安全点是重合的。

1.3、安全区域。在程序不执行的时候即没有分配CPU时间的时候，如何让其进入GC停顿呢？解决办法就是安全区域，即程序在一段代码片段中引用关系不会发生变化。在这个区域的任意地方进行GC都是安全的。在程序执行时，首先标识自己已经进入安全区域，离开时检查系统是否已经完成了GC枚举或者是整个GC过程，如果完成了线程就继续执行，否则必须等待直到收到可以安全离开的安全区的信号为止。

2、垃圾收集器。

2.1、Serial收集器。单线程的新生代收集器。在其进行垃圾收集时必须暂停其他所有的工作线程，直到其收集结束，这项工作全部是由虚拟机在后台自动发起和完成的。它是虚拟机运行在Client模式下的默认新生代收集器。

2.2、ParNew收集器。新生代的Serial收集器的多线程版本。除了使用多线程之外，其余包括Serial收集器可用的所有控制参数，收集算法、Stop The World、对象分配规则、回收策略等都与Serial收集器一样。是运行在Server模式下的虚拟机中首选的新生代收集器。

2.3、Parallel Scavenge收集器。新生代的并行多线程的收集器。其更注重的是吞吐量。吞吐量就是CPU用于运行用户代码的时间与CPU总消耗时间的比值，吞吐量=运行用户代码时间/(运行用户代码时间+垃圾收集时间)。

停顿时间越短就越适合与用户交互的程序，高吞吐量的适合后台运算而不需要太多交互的任务。

2.4、Serial Old收集器。老年代使用标记-整理算法的单线程收集器。一是给Client模式下的虚拟机使用，二是在Server模式下，作为CMS收集器的后备方案使用，在Concurrent Mode Failuer时使用。

2.5、Parallel Old收集器。是Parallel Scavenge的老年代版本，使用标记-整理算法。

2.6、CMS(Concurrent Mark Sweep)收集器。这是一个以获取最短回收停顿时间为目标的收集器。它分为4个运作过程：初始标记、并发标记、重新标记、并发清除。

2.6.1、初始标记和重新标记需要进行Stop The World。初始标记仅仅是标记一下GC Roots能直接关联到的对象，速度快。并发标记阶段就是进行GC Roots Tracing的过程，重新标记阶段则是为了修正并发标记期间因用户程序继续运作而导致标记产生变动的那一部分对象的标记记录，这个阶段停顿时间比初始标记时间长，远比并发标记时间短。

2.6.2、整个过程中耗时最长的并发标记和并发清除过程收集线程都可以与用户线程一起工作，所以总体来说，CMS收集器的内存回收过程是与用户线程一起并发执行的。

2.6.3、CMS的几个缺点：
2.6.3.1、一是CMS收集器对CPU资源非常敏感。

2.6.3.2、二是CMS收集器无法处理浮动垃圾，可能出现Concurrent Mode Failure失败而导致一次Full GC的产生，由于CMS并发清理阶段用户线程还在运行着，伴随程序运行自然就会有垃圾的产生，这一部分垃圾出现在标记之后，CMS无法在收集中处理掉它们，只能等到下一次GC再清理，这一部分垃圾就叫做浮动垃圾。由于垃圾收集阶段用户线程还需要运行，也就需要预留有足够的空间给用户线程使用，因此CMS不能像其他收集器那样等到老年代几乎完全被填满了再进行收集，需要预留一部分空间提供并发收集时的程序运作使用。要是CMS运行期间预留的孔家无法满足程序的需要，就会出现Concurrent Mode Failure失败，这时虚拟机将启动后备预案，临时启用Serial Old收集器来重新进行老年代的垃圾收集，这样停顿时间就很长了。可以通过参数进行调节。

2.6.3.3、三是此收集器是采用标记-清除算法，会产生空间碎片，导致很多大对象分配不到足够大的连续的内存，导致不得不进行一次Full GC。为了解决这个问题CMS提供了一个参数-XX:+UseCMSCompactAtFullCollection，用于在CMS顶不住时进行Full GC时开启内存碎片的合并整理过程，内存整理过程无法并发，因此停顿时间会变长。-XX:CMSFullGCsBeforeCompaction，这个参数用于设置执行多少次不压缩的Full GC后，跟着来一次压缩的。

2.7、G1收集器。面向服务端应用的垃圾收集器。
2.7.1、与其他收集器相比的优点：并行与并发、分代收集、空间整合(不会有碎片产生，标记-整理算法和复制算法)、可预测的停顿(能让使用者明确指定在一个长度为M毫秒的时间片段内，消耗在垃圾收集上的时间不得超过N毫秒)。

2.7.2、G1收集器将整个Java堆分为多个大小相等的独立区域(region)。G1之所以能建立可预测的停顿时间模型，是因为它可以有计划的规避在整个Java堆中进行全区域的垃圾收集。G1跟踪各个region里面的垃圾堆积的价值大小(回收所获得的空间大小以及回收所需时间的经验值)，在后台维护一个优先列表，每次根据允许的收集时间，优先回收价值最大的Region(Garbage First名称的由来)。这种使用Region划分内存空间以及有优先级的区域回收方式，保证了G1收集器在有限的时间内可以获取尽可能高的收集效率。

2.7.3、在G1收集器中Region之间的对象引用以及其他收集器中新生代与老年代之间的对象引用，虚拟机都是使用Remembered Set来避免全堆扫描的。G1中每个Region都有一个与之对应的Remembered Set，虚拟机发现程序在对Reference类型的数据进行写操作时，会产生一个Write Barrier暂时中断写操作，检查Reference引用的对象是否处于不同的Region之中(在分代的例子中就是检查是否老年代中的对象引用了新生代中的对象)，如果是便通过CardTable把相关引用信息记录到被引用的对象所属的Remembered Set之中。当进行内存回收时，在GC根节点的枚举范围中加入Remembered Set即可保证不对全堆扫描也不会有遗漏。

2.7.3、G1收集器的运作：初始标记、并发标记、最终标记、筛选回收。初始标记和并发标记和CMS收集器基本相同，并发标记就是做可达性分析，但是可以与用户线程并发执行。最终标记则是为了修正在并发标记期间因用户程序继续运作而导致标记产生变动的那一部分记录，虚拟机将这段时间对象的变化记录在线程Remembered Set Logs里，最终标记阶段需要把Remembered Set Logs的数据合并到Remembered Set中，这阶段需要停顿线程，但是可并行执行。最后筛选阶段首先对各个Region的回收价值和成本进行排序，根据用户所期望的GC停顿时间来制定回收计划。

2.8、垃圾收集器参数总结。
在这里插入图片描述