Google Research·· 2026-03-25
Google 发布 TurboQuant 向量压缩算法,KV cache 可压至 3 bit
TurboQuant: Redefining AI efficiency with extreme compression
AI 导读
Google Research 发布 TurboQuant 压缩算法,可在不损失模型精度的情况下把 KV cache 量化到 3 bit,无需训练或微调,并配套提出 QJL 与 PolarQuant 两种方法。
入选记录
门槛 60官方一手第一次 62第二次 62
入选两次之和 124 ≥ 门槛的两倍 120
- 信源等级
- 官方一手,这一级的门槛是 60 分
- 预筛
- 通过:Google Research发布AI向量压缩算法TurboQuant
- 推荐理由
- Google 官方给出 TurboQuant 的压缩机制与基准结果,读者可据此判断 KV cache 压缩的可行路径。
评分由模型按同一份标准独立打两次,满分 100;两次之和达到门槛的两倍才入选。门槛按信源等级设定。
来源:Google Research · research.google