Hugging Face Blog·· 2026-08-21
Liquid AI、LFM2.5-DSparkドラフトモデルを公開、推論を最大3.2倍高速化
Up to 3.2x Faster Inference with LFM2.5-DSpark
AI による要約
Liquid AIはLFM2.5-1.2B-Instruct、LFM2.5-2.6B、LFM2.5-8B-A1B向けDSparkドラフトモデルのチェックポイントを公開した。投機的デコーディングで出力品質を変えずに復号速度を上げ、GPUの処理量を最大3.18倍、端末上で最大2.87倍にした。
入選の記録
基準 60公式・一次情報1 回目 622 回目 62
入選二回の合計 124 ≥ 基準の 2 倍 120
- 情報源の区分
- 公式・一次情報、この区分の基準は 60 点
- 予備審査
- 通過:发布AI模型推理加速技术
- 推薦理由
- 3つのLFM2.5ドラフトモデルの実測処理量と関数呼び出し遅延から、端末上の推論を高速化できる余地がわかる。
採点はモデルが同じ基準で独立に二回行い、満点は 100。二回の合計が基準の 2 倍に届いたものだけが入選します。基準は情報源の区分ごとに決めています。
情報源:Hugging Face Blog · huggingface.co