新模型
2026-09-18
Bonsai 2 开源:体积缩到九分之一,普通电脑也能跑
Bonsai 2 开源:体积缩到九分之一,普通电脑也能跑
一句话说清:一个 27B 的大模型被压成 5.9GB,只有原来的九分之一大,还保留了 98% 的水平,能在自己的电脑上离线跑。
发生了什么
2026 年 9 月 17 日,美国 AI 公司 PrismML 发布了 Bonsai 2 27B 的三值压缩版,国内媒体 9 月 18 日跟进报道。
- 它是在阿里 Qwen3.8 27B 的基础上"压"出来的:把每个参数只保留 -1、0、1 三种取值,文件从大约 54GB 缩到 5.9GB。
- 官方称:在 20 项测试里平均得分 83.9,保留了原模型 98.2% 的能力(上一代是 95%,这一代把差距进一步收窄)。
- 速度上,一张 RTX 5090 显卡最高约每秒 143 个词元,苹果 M5 Max 笔记本上约 47 个词元。
- 权重按 Apache 2.0 协议免费开放(可以商用),在 Hugging Face、魔搭社区都能下载。
- 支持 262K 的长上下文(一次性可以读完很长的文档),还能看图。
来源:PrismML 官方(2026-09-17)、IT之家(2026-09-18)、DataNorth AI(2026-09-17)。
对我有什么用
- 以前想在本地跑大模型,得买好几万的专业显卡;5.9GB 这个体积,一台中端笔记本或游戏本就有机会跑起来。
- 数据不出自己的电脑:合同、病例、公司内部资料这类不能外传的东西,可以放心喂给它。
- 免费可商用,小团队做内部小工具不用再为接口费用发愁。
- 断网也能用,出差、信号差的地方照样干活。
我可以怎么做
- 打开魔搭 ModelScope 或 Hugging Face,搜索 "Ternary Bonsai 2 27B"。
- 按页面说明下载模型文件(大约 6~7GB)。
- 用官方配套的本地运行工具加载,就能开始离线对话。
- 完全不懂技术也没关系:等各家把这类"小体积模型"做进现成 App,用起来会更省事,目前先用网页版 AI 就够。
温馨提醒
- 压缩一定会掉一点能力。官方自己给的数据里,"知识问答"和"看图认字"掉得相对多(长文推理类约降 9 分),编程和数学基本没掉。
- 5.9GB 只是模型文件本身的体积,真正跑起来还要额外内存,建议 16GB 以上内存的电脑再尝试。
- 目前的性能数字都是厂商自己测的,还没有第三方独立评测,别当成定论。
- 本地模型同样会答错,重要的事自己核对。
📤 一键转发小助手
帮你写好小红书文案、微信群推荐语,还配一张中文海报,复制就能发
💬 说说你的看法