新模型
2026-09-13
英伟达开源 IMO 金牌数学推理方案 Nemotron
英伟达开源 IMO 金牌数学推理方案 Nemotron
一句话说清:英伟达把一套在2026年国际数学奥林匹克(IMO)拿到金牌分数(30/42)的纯自然语言数学推理方案开源了,模型权重、训练数据、代码、解题过程全部公开,谁都能复现。
发生了什么
2026年9月,英伟达研究团队发布基于 Nemotron 3 Ultra 的数学推理系统,在 IMO 2026 拿到 30/42 分、超过29分的金牌线(来源:DEV Community / arXiv 论文,2026-09-12)。
- 全程只用自然语言推理,不依赖形式化证明器(如 Lean)、不联网、不用外部工具,靠模型自己生成、验证、改证明。
- 英伟达同步开源了两个专家模型权重、训练数据、推理代码、提交的解题过程,以及一个含200道奥数题的新基准 Nemotron-IMO-Bench。
- 论文9月9日发在 arXiv(编号 2609.10712),团队由 Ivan Moshkov 等六人组成。
对我有什么用
- 对学生/数学爱好者:这是目前最透明、可复现的「AI 解奥数题」方案,等于白送一套研究方法,想深入研究数学 AI 的人能直接拿来跑、拿来改。
- 对开发者:它演示了「用后训练把通用大模型变成领域专家」的成熟套路(监督微调+强化学习+测试时算力),做自己行业的专用 AI 可照搬。
我可以怎么做
- 上 Hugging Face 搜 NVIDIA 的 Nemotron-IMO 合集,下载两个专家权重和推理代码。
- 按 GitHub 上的 recipe 跑推理,输入一道奥数题,看它怎么一步步生成并验证证明。
- 普通用户没显卡也没关系:直接体验各家已上线的数学/解题助手(如 ChatGPT、Kimi、智谱),它们背后都有类似思路。
温馨提醒
- 不是家用级:单个专家权重约1.12TB,官方建议至少8张 B200 级 GPU,个人基本跑不了,主要是给研究机构用的。
- 作者自己承认有「盲区」:模型自己打分偏高(约32分),官方只认30分;且证明没有机器严格校验,权威仍以人类阅卷为准。
- 训练数据部分由别家模型(DeepSeek-V4-Pro)生成,会继承其可能的错误,引用结论时要自行核对。
📤 一键转发小助手
帮你写好小红书文案、微信群推荐语,还配一张中文海报,复制就能发
💬 说说你的看法