Hugging Face Blog·· 2026-08-21精选AI 评分68
Liquid AI 发布 LFM2.5-DSpark 草稿模型,推理最高加速 3.2 倍
Up to 3.2x Faster Inference with LFM2.5-DSpark
AI 导读
Liquid AI 发布 LFM2.5-1.2B-Instruct、LFM2.5-2.6B 和 LFM2.5-8B-A1B 的 DSpark 草稿模型,通过 speculative decoding 提升推理吞吐。
推荐理由
文章同时给出 H100 与 M4 Max 的吞吐对比、function-calling 延迟变化及 llama.cpp 和 SGLang 接入方式,便于评估 DSpark 在云端与端侧部署中的收益。
来源:Hugging Face Blog · huggingface.co