Hugging Face Blog·· 2026-08-21精选AI 评分62
Liquid AI 发布 LFM2.5-DSpark 草稿模型,推理速度最高提升 3.18 倍
Up to 3.2x Faster Inference with LFM2.5-DSpark
AI 导读
Liquid AI 发布 LFM2.5 系列三款模型的 DSpark 草稿模型检查点,通过投机解码在 GPU 上实现最高 3.18 倍吞吐提升,端侧最高 2.87 倍,且不改变输出质量。LFM2.5-2.6B 的函数调用延迟平均降低 57%,并已开源支持 llama.cpp 和 SGLang。
推荐理由
原文给出了三款草稿模型的加速数据和接入方式,读者可据此评估投机解码带来的实际收益。
来源:Hugging Face Blog · huggingface.co