跳到正文
原文
Google Research·· 2026-03-25

Google 发布 TurboQuant 向量压缩算法,KV cache 可压至 3 bit

TurboQuant: Redefining AI efficiency with extreme compression

AI 导读

Google Research 发布 TurboQuant 压缩算法,可在不损失模型精度的情况下把 KV cache 量化到 3 bit,无需训练或微调,并配套提出 QJL 与 PolarQuant 两种方法。

入选记录

入选两次之和 124 ≥ 门槛的两倍 120

信源等级
官方一手,这一级的门槛是 60 分
预筛
通过:Google Research发布AI向量压缩算法TurboQuant
推荐理由
Google 官方给出 TurboQuant 的压缩机制与基准结果,读者可据此判断 KV cache 压缩的可行路径。

评分由模型按同一份标准独立打两次,满分 100;两次之和达到门槛的两倍才入选。门槛按信源等级设定。

来源:Google Research · research.google