跳到正文
原文
Mistral AI·· 2026-01-22精选AI 评分71

Mistral AI 如何定位并修复 vLLM 中的内存泄漏

Heaps do lie: debugging a memory leak in vLLM.

AI 导读

Mistral AI 调查发现,vLLM 在使用 Mistral Medium 3.1、Prefill/Decode 分离服务、NIXL 和图编译时,系统内存会以 400 MB per minute 增长。

推荐理由

文章完整呈现了从 Heaptrack、pmap 到 BPFtrace 和 GDB 的排查链路,并给出可直接缓解 vLLM 内存泄漏的 UCX 配置。

来源:Mistral AI · mistral.ai