
垃圾回收(Garbage Collection, GC)是Java自动内存管理的核心机制,它自动识别和回收不再使用的对象,释放内存空间。Java虚拟机(JVM)提供了多种垃圾回收算法,每种算法都有其特点和适用场景。本文将全面介绍Java中的主要垃圾回收算法,包括它们的原理、实现方式、优缺点以及适用场景。
一、垃圾回收基础概念
在深入探讨具体算法之前,我们先了解一些垃圾回收的基础概念:
- 可达性分析:判断对象是否存活的算法,从GC Roots对象开始,通过引用链不可达的对象即为可回收对象
- Stop-The-World:垃圾回收时暂停所有应用线程的现象
- 吞吐量:应用运行时间占总时间(应用运行+GC时间)的比例
- 停顿时间:垃圾回收导致的应用停顿时间
- 内存碎片:内存被分割成不连续小块的现象
二、主要垃圾回收算法
Java中的垃圾回收算法可以分为以下几类:
1. 标记-清除算法(Mark-Sweep)
原理:
- 标记阶段:从GC Roots开始遍历,标记所有可达对象
- 清除阶段:回收未被标记的对象占用的内存空间
实现示例:
// 伪代码表示标记-清除算法
void markSweep() {
// 标记阶段
for (Object root : gcRoots) {
mark(root);
}
// 清除阶段
for (Object obj : heap) {
if (!obj.isMarked()) {
free(obj);
} else {
obj.unmark();
}
}
}
void mark(Object obj) {
if (obj == null || obj.isMarked()) return;
obj.mark();
for (Object ref : obj.getReferences()) {
mark(ref);
}
}
优点:
- 实现简单
- 不需要移动对象,适合存活对象多的情况
缺点:
- 产生内存碎片
- 分配内存时需要遍历空闲列表,效率较低
- 执行效率不稳定,堆越大标记和清除时间越长
适用场景:
- 老年代回收(如CMS收集器的老年代回收阶段)
2. 标记-复制算法(Mark-Copy)
原理:
- 将内存分为大小相等的两块(From空间和To空间)
- 每次只使用其中一块(From空间)
- 垃圾回收时,将From空间存活对象复制到To空间
- 复制完成后,清空From空间,并交换From和To空间的角色
内存布局:
Before GC:
[From空间][To空间]
A B C 空
After GC:
[From空间][To空间]
空 A B
(C被回收)
优点:
- 无内存碎片问题
- 分配内存时只需移动指针,效率高
- 适合对象存活率低的场景
缺点:
- 内存利用率只有50%
- 存活对象多时复制开销大
适用场景:
- 新生代回收(如Serial、Parallel Scavenge、G1等收集器的新生代)
变种:
- Apple式回收:将内存分为更多块,不限于两块
- 新生代通常采用一个Eden区和两个Survivor区(8:1:1比例)的实现
3. 标记-整理算法(Mark-Compact)
原理:
- 标记阶段:与标记-清除算法相同,标记所有可达对象
- 整理阶段:将所有存活对象向内存一端移动,然后清理边界外的内存
内存布局变化:
Before GC:
[A][空][B][空][C][D][空]
After GC:
[A][B][C][D][空][空][空]
优点:
- 无内存碎片问题
- 内存利用率高
缺点:
- 移动对象成本高
- 需要暂停用户线程(Stop-The-World)
适用场景:
- 老年代回收(如Serial Old、Parallel Old收集器)
4. 分代收集算法(Generational Collection)
原理:
- 基于"弱代假说":大多数对象很快变得不可达
- 将堆分为新生代(Young Generation)和老年代(Old Generation)
- 新生代使用标记-复制算法
- 老年代使用标记-清除或标记-整理算法
分代内存布局:
[Eden][Survivor0][Survivor1][Old Generation]
对象晋升过程:
- 对象首先在Eden区分配
- 第一次GC后存活对象移动到Survivor0
- 下次GC时,Eden和Survivor0存活对象复制到Survivor1
- 经过多次GC(默认15次)仍存活的对象晋升到老年代
优点:
- 针对不同代特点采用最优算法
- 综合性能好
缺点:
- 实现复杂
- 需要维护跨代引用
适用场景:
- 现代JVM的主流收集策略
三、现代垃圾收集器实现
Java虚拟机提供了多种垃圾收集器实现,它们基于上述算法但各有优化:
1. Serial收集器
- 单线程收集器
- 新生代:标记-复制
- 老年代:标记-整理
- 适用:客户端模式、小内存应用
2. Parallel Scavenge收集器
- 多线程并行收集
- 新生代:标记-复制
- 老年代:标记-整理
- 目标:高吞吐量
- 适用:后台计算型应用
3. ParNew收集器
- Parallel Scavenge的多线程版本
- 与CMS配合使用
4. CMS(Concurrent Mark-Sweep)收集器
- 目标:最小化停顿时间
- 老年代:并发标记-清除
- 阶段:
- 初始标记(STW)
- 并发标记
- 重新标记(STW)
- 并发清除
- 缺点:内存碎片、并发模式失败风险
5. G1(Garbage-First)收集器
- 面向服务端的收集器
- 将堆划分为多个Region
- 预测停顿时间模型
- 阶段:
- 初始标记(STW)
- 并发标记
- 最终标记(STW)
- 筛选回收(STW)
- 优点:兼顾吞吐量和停顿时间
6. ZGC和Shenandoah
- 超低延迟收集器(目标停顿时间<10ms)
- 几乎全并发操作
- 使用读屏障、染色指针等技术
- 适用:大内存、低延迟要求的应用
四、垃圾回收算法的选择与调优
选择考虑因素
-
应用特点:
- 吞吐量优先 vs 低延迟优先
- 堆内存大小
- 对象生命周期分布
-
硬件环境:
- CPU核心数
- 内存大小和带宽
常见组合与适用场景
| 组合 | 新生代 | 老年代 | 适用场景 |
|---|---|---|---|
| Serial+Serial Old | 标记-复制 | 标记-整理 | 客户端应用、小堆 |
| Parallel Scavenge+Parallel Old | 标记-复制 | 标记-整理 | 吞吐量优先、计算密集型 |
| ParNew+CMS | 标记-复制 | 并发标记-清除 | 低延迟、Web应用 |
| G1 | 分Region收集 | 分Region收集 | 大堆、平衡吞吐与延迟 |
| ZGC | 全堆并发 | 全堆并发 | 超大堆、极低延迟 |
调优参数示例
-
设置堆大小:
-Xms4g -Xmx4g # 初始和最大堆大小 -
设置新生代大小:
-Xmn2g # 新生代2GB -
选择收集器:
-XX:+UseG1GC # 使用G1收集器 -XX:+UseConcMarkSweepGC # 使用CMS收集器 -
调整GC日志:
-Xlog:gc*:file=gc.log:time:filecount=10,filesize=10M
五、垃圾回收算法的发展趋势
-
低延迟化:
- ZGC、Shenandoah等几乎全并发的收集器
- 停顿时间从毫秒级向亚毫秒级发展
-
大内存支持:
- 支持TB级堆内存的收集算法
- 减少内存占用和带宽压力
-
异构计算:
- 利用GPU等加速垃圾回收
- 并行化算法优化
-
云原生适应:
- 容器感知的GC策略
- 弹性内存管理
六、常见问题与解决方案
问题1:频繁Full GC
可能原因:
- 老年代空间不足
- 内存泄漏
- 晋升阈值设置不合理
解决方案:
- 增加堆大小或老年代比例
- 检查内存泄漏
- 调整-XX:MaxTenuringThreshold
问题2:长时间GC停顿
可能原因:
- 大对象分配
- 引用处理耗时
- 堆过大
解决方案:
- 使用G1或ZGC等低延迟收集器
- 避免大对象
- 分拆大堆为分布式服务
问题3:高GC开销
可能原因:
- 对象分配率过高
- 过早晋升
- Survivor空间不足
解决方案:
- 优化对象创建模式
- 调整新生代大小
- 增加Survivor空间(-XX:SurvivorRatio)
七、总结
Java垃圾回收算法从基础的标记-清除、标记-复制、标记-整理,发展到现代的分代收集和全并发收集,不断演进以满足不同应用场景的需求。理解这些算法的原理和特点,有助于开发人员:
- 根据应用特点选择合适的垃圾收集器
- 进行有效的JVM调优
- 编写GC友好的代码
- 诊断和解决内存相关性能问题
随着硬件技术的发展和应用需求的变化,垃圾回收技术仍在不断创新,未来我们将看到更多高效、智能的垃圾回收算法出现。

1114

被折叠的 条评论
为什么被折叠?



