PrismML 发 Ternary Bonsai 2 27B:真三元 1.72 bit/权重,5.9GB 跑 262K 上下文
PrismML 9 月 17 日(官方公告页 datePublished)发布 Ternary Bonsai 2 27B:基于 Qwen3.8 27B 的多模态旗舰,端到端三元语言权重覆盖 embeddings、attention、MLP 与 LM head,无高精度逃生通道,信息论表示密度 1.72 bit/权重(MLX 存储为 2.25 bit)。官方称保留原模型 98.2% 性能,262K token 端上上下文由 Qwen3.8 混合注意力骨干(约 75% 线性注意力)支撑。
权重以 Apache 2.0 开源:MLX 2-bit 打包 5.9GB 可跑笔记本,1-bit 3.9GB 跑 iPhone 17 Pro;另有 GGUF 伴生仓库供 llama.cpp 使用。配套 MLX(Python/Swift)与 CUDA 自研三元混合注意力内核,打包权重直接消费、从不回扩 FP16。上一代 Bonsai 27B 三元变体保留约 95%,两代间隔两个月。
原文链接:PrismML 官方公告页
核验记录
官方公告页 JSON-LD datePublished 2026-09-17 直读;HF 仓库(mlx-2bit 9/17)与 MarkTechPost 9/18 发稿交叉;OpenRouter 9/18 上架互证