跳到正文
原文
Hugging Face Blog·· 2026-08-21精选AI 评分65

Liquid AI 发布 LFM2.5-DSpark 草稿模型,实现最高 3.2x 推理加速

Up to 3.2x Faster Inference with LFM2.5-DSpark

AI 导读

Liquid AI 发布适用于 LFM2.5 系列模型的 DSpark 草稿检查点,通过推测解码技术在不改变输出质量的前提下显著提升推理速度。该方案在 H100 GPU 上最高实现 3.18x 吞吐提升,在 M4 Max MacBook Pro 端侧最高实现 2.87x 加速,并已将 llama.cpp 和 SGLang 的集成代码开源。

推荐理由

原文提供了DSpark草稿模型在GPU和端侧的具体加速数据及开源集成方案,读者可据此评估其在本地部署中的性能收益。

来源:Hugging Face Blog · huggingface.co