公司动态
【JVM调优实战】32-案例-高并发网关GC停顿优化
案例:高并发网关的 GC 停顿优化本文是《JVM调优实战》专栏第 32 讲。引言API 网关是所有流量的"守门人"。上游调用方设置了 200ms 超时,你的网关必须在极短时间内完成鉴权、路由、限流、协议转换。打个比方:网关就像超市的收银台,如果收银员偶尔"卡住"200ms,顾客还能忍;但如果 100 个收银台同时卡住,顾客就会扔掉购物车走人 — — 这就是调用方超时重试后的雪崩效应。本文记录了一个 G1 收集器在低延迟场景下"翻车"的案例。网关的 SLO 要求 P99 延迟小于 50ms,但 G1 混合 GC 偶尔出现 200ms+ 的停顿。最终通过迁移到 ZGC,将 GC 停顿从 200ms 降到了亚毫秒级(1ms)。问题现象API 网关服务运行在 16 核 16GB 的虚拟机上,JDK 11,使用 G1 收集器。日常 QPS 约 3 万,P99 延迟稳定在 30ms 以内。但每隔 20-30 分钟,监控曲线就会出现尖刺:时间段P50 延迟P99 延迟P999 延迟每分钟超时次数正常时8ms28ms65ms0