新模型 2026-09-13

英伟达开源 IMO 金牌数学推理方案 Nemotron

来源:DEV Community

英伟达开源 IMO 金牌数学推理方案 Nemotron

一句话说清:英伟达把一套在2026年国际数学奥林匹克(IMO)拿到金牌分数(30/42)的纯自然语言数学推理方案开源了,模型权重、训练数据、代码、解题过程全部公开,谁都能复现。

发生了什么

2026年9月,英伟达研究团队发布基于 Nemotron 3 Ultra 的数学推理系统,在 IMO 2026 拿到 30/42 分、超过29分的金牌线(来源:DEV Community / arXiv 论文,2026-09-12)。

  • 全程只用自然语言推理,不依赖形式化证明器(如 Lean)、不联网、不用外部工具,靠模型自己生成、验证、改证明。
  • 英伟达同步开源了两个专家模型权重、训练数据、推理代码、提交的解题过程,以及一个含200道奥数题的新基准 Nemotron-IMO-Bench。
  • 论文9月9日发在 arXiv(编号 2609.10712),团队由 Ivan Moshkov 等六人组成。

对我有什么用

  • 对学生/数学爱好者:这是目前最透明、可复现的「AI 解奥数题」方案,等于白送一套研究方法,想深入研究数学 AI 的人能直接拿来跑、拿来改。
  • 对开发者:它演示了「用后训练把通用大模型变成领域专家」的成熟套路(监督微调+强化学习+测试时算力),做自己行业的专用 AI 可照搬。

我可以怎么做

  1. 上 Hugging Face 搜 NVIDIA 的 Nemotron-IMO 合集,下载两个专家权重和推理代码。
  2. 按 GitHub 上的 recipe 跑推理,输入一道奥数题,看它怎么一步步生成并验证证明。
  3. 普通用户没显卡也没关系:直接体验各家已上线的数学/解题助手(如 ChatGPT、Kimi、智谱),它们背后都有类似思路。

温馨提醒

  • 不是家用级:单个专家权重约1.12TB,官方建议至少8张 B200 级 GPU,个人基本跑不了,主要是给研究机构用的。
  • 作者自己承认有「盲区」:模型自己打分偏高(约32分),官方只认30分;且证明没有机器严格校验,权威仍以人类阅卷为准。
  • 训练数据部分由别家模型(DeepSeek-V4-Pro)生成,会继承其可能的错误,引用结论时要自行核对。
📤 一键转发小助手 帮你写好小红书文案、微信群推荐语,还配一张中文海报,复制就能发