跳到正文
原文
Hugging Face Blog·· 2026-08-21精选AI 评分60

Liquid AI 发布 LFM2.5-DSpark 草稿模型,推理速度最高提升 3.2 倍

Up to 3.2x Faster Inference with LFM2.5-DSpark

AI 导读

Liquid AI 为 LFM2.5 系列三个模型(LFM2.5-1.2B-Instruct、LFM2.5-2.6B、LFM2.5-8B-A1B)发布 DSpark 草稿模型检查点,通过投机解码在保持输出质量不变的前提下实现最高 3.18 倍 GPU 吞吐提升和 2.87 倍端侧提升。

推荐理由

原文给出了LFM2.5系列三个模型的DSpark草稿模型检查点及实测吞吐数据,读者可据此评估其推理加速方案在GPU和端侧的实际收益。

来源:Hugging Face Blog · huggingface.co