新模型 2026-09-16

国产开源大模型 Atria Dawn 亮相:7440亿参数智能体,商用免费

国产开源大模型 Atria Dawn 亮相:7440亿参数智能体,商用免费

一句话说清:上海人工智能实验室把一款 7440 亿参数的“会自己干活的 AI 智能体”模型开源了,谁都能免费下载商用。

发生了什么

9 月 16 日前后,上海人工智能实验室(Shanghai AI Lab)低调开源了一款叫 Atria Dawn Preview 的 AI 智能体模型。它规模巨大——总参数约 7440 亿(744B),用的是混合专家架构,每次只激活其中约 400 亿参数,所以能跑得动。

它的底座是智谱的 GLM-5.2(同样开源、MIT 许可),上海 AI 实验室在其之上做了专门的“智能体训练”:让模型学会一整套干活的流程——分析问题、自己调用工具、写代码并运行、看结果、失败了再重试,而不是像普通聊天机器人那样一问一答。

几个关键点:

  • 完全开源、MIT 许可:意味着个人和公司都能免费下载、修改、拿去商用,OpenAI、Anthropic 的旗舰模型都没给过这种宽松授权。
  • 256K 上下文,代码和论文分别在 GitHub、Hugging Face、ModelScope 放出,还提供了兼容其它厂商接口的 API。
  • 官方公布的 16 项测试里,它在“深度搜索、浏览器操作、网络安全”等 5 项拿了第一(例如 BrowseComp 92.5 分、DeepSearchQA 96.0 分)。

对我有什么用

过去大厂把“会自己调工具、跑长任务”的智能体能力看得很紧,不愿公开。这次一家国家级实验室把它免费扔到网上,而且没有任何使用限制、没有发布会的铺垫。

它说明国产开源模型的“ compounding(滚雪球)”速度很快:智谱做底座,上海 AI 实验室做后训练,一个季度内就接连开源。对开发者和小团队来说,这意味着不用花大钱调别人的收费接口,也能用上接近前沿水平的“自主干活”模型。

我可以怎么做

  • 普通用户:暂时用不上原模型本身(它太大,个人电脑跑不动),但可以关注基于它做的产品,或等国内平台接入后体验“能自己查资料、写代码、出报告”的智能体。
  • 开发者 / 想折腾的人:去 Hugging Face 或 ModelScope 搜 Atria Dawn Preview,用 SGLang、vLLM 等框架本地部署;想省显存就用官方提供的 FP8 精简版。

温馨提醒

  • 这些分数都是实验室自己报的,目前还没有独立第三方复测,先看别全信。
  • 模型只认文字输入,不支持看图;上下文 256K,比一些对手短。
  • 想自己部署,权重约需 756GB~1.5TB 显存/内存,普通人别硬上,等云端服务更现实。
📤 一键转发小助手 帮你写好小红书文案、微信群推荐语,还配一张中文海报,复制就能发