E-Ink 新闻日报

返回列表

Bonsai 2 27B:在9倍更小体积下实现近无损压缩

PrismML发布了Ternary Bonsai 2 27B,基于Qwen3.8 27B采用三元权重({−1, 0, +1})与FP16分组缩放进行近无损压缩,有效比特数仅1.76位,模型体积仅5.9GB。该模型在体积缩小9倍的同时保留了全精度版本98.2%的基准性能,支持262K上下文窗口和图文多模态输入,以Apache 2.0协议开源。

背景

模型压缩与量化对于在边缘设备和本地硬件上部署大型AI模型至关重要。三元量化将权重减少到三个值(−1, 0, +1),在尽可能保留性能的同时大幅缩小模型体积。

来源
Lobsters
发布时间
2026年9月18日 16:28
评分
7.0 / 10