新模型 2026-09-08

Mercury 2.5 扩散大模型发布:每秒 1107 字、价格打到底

来源:Inception Labs

Mercury 2.5 扩散大模型发布:每秒 1107 字、价格打到底

一句话说清:AI 公司 Inception 推出 Mercury 2.5,用“扩散”新路子生成文字,速度达到每秒 1107 字(传统模型一般每秒六七十字),首发价低到每百万字输入只要 0.04 美元,等于又一轮“AI 变快变便宜”。

发生了什么

2026 年 9 月 8 日,Inception Labs 发布 Mercury 2.5,号称“迄今最大的扩散语言模型”(来源:Inception Labs 官方博客,2026-09-08)。

  • 传统大模型(GPT、Claude、Gemini 这类)是一个字一个字往外蹦;Mercury 用“扩散”思路,先把整段草稿生成出来再并行精修,所以特别快。
  • 实测速度 1107 tokens/秒,上下文拉长到 26 万 token;官方称质量接近 Claude Haiku 4.5、Gemini 3.5 Flash-Lite、GPT-5.6 Luna 这些“便宜好用”的标杆模型。
  • 价格:标价每百万输入 0.20 美元、输出 0.75 美元;首发 8 折优惠后只要输入 0.04、输出 0.15 美元,已在 OpenRouter、Baseten、Inception API 上线。
  • 已有落地案例:做 AI 电话客服的 OpenCall 换上它后,响应延迟从几百毫秒降到约 170 毫秒;编程助手 Augment Code 用它做“压缩长上下文”,耗时从 150 秒降到 27 秒、成本降 90%。

对我有什么用

  • 你不一定直接用它,但你用的很多 AI 写作、客服、翻译类工具,底层模型一旦换成这种“快又便宜”的扩散模型,你体感就是:回复更快、价格更便宜。
  • 这是大模型“降本提速”的又一步,长期看会摊薄所有 AI 产品的成本——对普通用户是好事。

我可以怎么做

  1. 想自己体验:去 OpenRouter 搜 Mercury 2.5(预览模型),注册后可按量试用,体验“秒出长文”的速度。
  2. 开发者:在 Inception API / Baseten 调用,写代码时指定模型名为 mercury(注意是付费 API,非免费 App)。
  3. 普通用户:留意你常用的写作/客服类 AI 工具后续是否宣传“接入更快模型”,那大概率就是这类技术红利外溢。

温馨提醒

  • Mercury 2.5 主要面向开发者和企业 API,不是给普通人直接聊天的 App;普通人体验到的是“它背后的工具变快变便宜”。
  • 速度是 Inception 自家测试结果,不同硬件/场景会有差异;首发 0.04/0.15 美元是限时折扣,官网未说明结束时间,长期价以 0.20/0.75 标价为准。
  • 质量为厂商自测对比,暂无独立第三方榜单背书,理性看待宣传数字。
📤 一键转发小助手 帮你写好小红书文案、微信群推荐语,还配一张中文海报,复制就能发