跳到正文
原文
Hugging Face Blog·· 2026-08-21精选AI 评分82

Liquid AI 发布 LFM2.5-DSpark 草稿模型,推理速度最高提升 3.18 倍

Up to 3.2x Faster Inference with LFM2.5-DSpark

AI 导读

Liquid AI 发布 LFM2.5-1.2B-Instruct、LFM2.5-2.6B 和 LFM2.5-8B-A1B 的 DSpark 草稿模型,通过 speculative decoding 在不改变 greedy decoding 输出的前提下提升推理速度。

推荐理由

LFM2.5-DSpark同时给出H100与M4 Max上的实测加速、函数调用延迟变化和llama.cpp及SGLang接入方式,便于评估部署收益。

来源:Hugging Face Blog · huggingface.co