PrismML发布了Ternary Bonsai 2 27B,基于Qwen3.8 27B采用三元权重({−1, 0, +1})与FP16分组缩放进行近无损压缩,有效比特数仅1.76位,模型体积仅5.9GB。该模型在体积缩小9倍的同时保留了全精度版本98.2%的基准性能,支持262K上下文窗口和图文多模态输入,以Apache 2.0协议开源。
背景
模型压缩与量化对于在边缘设备和本地硬件上部署大型AI模型至关重要。三元量化将权重减少到三个值(−1, 0, +1),在尽可能保留性能的同时大幅缩小模型体积。
- 来源
- Lobsters
- 发布时间
- 2026年9月18日 16:28
- 评分
- 7.0 / 10