Mistral AI·· 2026-01-22精选AI 评分71
Mistral AI 如何定位并修复 vLLM 中的内存泄漏
Heaps do lie: debugging a memory leak in vLLM.
AI 导读
Mistral AI 调查发现,vLLM 在使用 Mistral Medium 3.1、Prefill/Decode 分离服务、NIXL 和图编译时,系统内存会以 400 MB per minute 增长。
推荐理由
文章完整呈现了从 Heaptrack、pmap 到 BPFtrace 和 GDB 的排查链路,并给出可直接缓解 vLLM 内存泄漏的 UCX 配置。
来源:Mistral AI · mistral.ai