新模型 2026-09-18

Bonsai 2 开源:体积缩到九分之一,普通电脑也能跑

Bonsai 2 开源:体积缩到九分之一,普通电脑也能跑

一句话说清:一个 27B 的大模型被压成 5.9GB,只有原来的九分之一大,还保留了 98% 的水平,能在自己的电脑上离线跑。

发生了什么

2026 年 9 月 17 日,美国 AI 公司 PrismML 发布了 Bonsai 2 27B 的三值压缩版,国内媒体 9 月 18 日跟进报道。

  • 它是在阿里 Qwen3.8 27B 的基础上"压"出来的:把每个参数只保留 -1、0、1 三种取值,文件从大约 54GB 缩到 5.9GB。
  • 官方称:在 20 项测试里平均得分 83.9,保留了原模型 98.2% 的能力(上一代是 95%,这一代把差距进一步收窄)。
  • 速度上,一张 RTX 5090 显卡最高约每秒 143 个词元,苹果 M5 Max 笔记本上约 47 个词元。
  • 权重按 Apache 2.0 协议免费开放(可以商用),在 Hugging Face、魔搭社区都能下载。
  • 支持 262K 的长上下文(一次性可以读完很长的文档),还能看图。

来源:PrismML 官方(2026-09-17)、IT之家(2026-09-18)、DataNorth AI(2026-09-17)。

对我有什么用

  • 以前想在本地跑大模型,得买好几万的专业显卡;5.9GB 这个体积,一台中端笔记本或游戏本就有机会跑起来。
  • 数据不出自己的电脑:合同、病例、公司内部资料这类不能外传的东西,可以放心喂给它。
  • 免费可商用,小团队做内部小工具不用再为接口费用发愁。
  • 断网也能用,出差、信号差的地方照样干活。

我可以怎么做

  1. 打开魔搭 ModelScope 或 Hugging Face,搜索 "Ternary Bonsai 2 27B"。
  2. 按页面说明下载模型文件(大约 6~7GB)。
  3. 用官方配套的本地运行工具加载,就能开始离线对话。
  4. 完全不懂技术也没关系:等各家把这类"小体积模型"做进现成 App,用起来会更省事,目前先用网页版 AI 就够。

温馨提醒

  • 压缩一定会掉一点能力。官方自己给的数据里,"知识问答"和"看图认字"掉得相对多(长文推理类约降 9 分),编程和数学基本没掉。
  • 5.9GB 只是模型文件本身的体积,真正跑起来还要额外内存,建议 16GB 以上内存的电脑再尝试。
  • 目前的性能数字都是厂商自己测的,还没有第三方独立评测,别当成定论。
  • 本地模型同样会答错,重要的事自己核对。
📤 一键转发小助手 帮你写好小红书文案、微信群推荐语,还配一张中文海报,复制就能发