在2026年国际数学奥林匹克竞赛官方特别邀请下,华为小艺AI竞赛Agent参加这一全球顶级数学赛事。经过连续两天竞赛与严格评审,系统完成全部六道赛题,以42分满分达到金牌标准。
这一成绩展现了小艺 Agent在代数、几何、数论和组合数学等领域的综合求解能力,也标志着华为AI在复杂问题建模、长程推理、工具协同和严格验证等方向取得重要突破。
IMO主席Gregor Dolinar教授表示:
“Congratulations! The solutions from HUAWEI have achieved a perfect score of 42 points on the problems of the 67th International Mathematical Olympiad.”
“祝贺!华为提交的解答在第67届国际数学奥林匹克竞赛中获得42分满分。”

一、不只是满分:AI开始用不同于人类的方式解决数学难题
IMO 2026六道题横跨数论、几何、对抗博弈、函数方程和递推序列。真正令人惊喜的,不只是华为小艺AI完成了全部题目,更在于我们看到:AI不必完全复制人类数学家的思维,也能抵达新的解题边界。
人类解题往往依赖一条高度凝练的主线和关键时刻的“灵光一现”;Agentic系统则更像一支协同工作的数学研究团队。多个Agent可以同时提出猜想、探索不同路线、寻找反例、验证引理,并根据进展动态调整资源。这也体现了AI从“Copilot辅助回答”向“Agent自主完成复杂任务”的演进。
面对第3题和第4题的组合博弈,系统让不同Agent分别扮演策略提出者、对手和裁判,通过代码枚举、策略模拟和反例搜索,形成“提出猜想—环境执行—反例攻击—策略修正”的闭环。对人类而言难以捕捉的灵感,被转化为可以反复实验和验证的对象。
在第2题几何证明中,系统并不押注唯一的解法,而是同时探索纯几何、复数、坐标和符号推导等路线。不同Agent分别发现结构、压缩关系和检查关键等式,再由Verifier交叉验证。人类通常追求一条最优雅的证明,AI则可以让多种数学语言同时“投票”,降低早期路线选择错误带来的风险。
面对第5题、第6题这样的长程证明,系统利用持续更新的“证明状态图”,记录关键引理、任务依赖、反例和失败路径。探索Agent负责开辟新路线,子问题Agent攻克局部难点,Verifier检查逻辑漏洞,调度Agent将资源投入更有希望的方向。路线失败时,系统能够精准回退,而不是重新开始。
因此,IMO 2026满分突破并不只是模型规模增长,而是一种新型智能系统的验证:像研究团队一样协作,像程序一样执行,像审稿人一样质疑,并记住每一次成功与失败。
二、满分是里程碑,也是走向真实世界的新起点
华为小艺AI团队衷心感谢IMO组委会的专业组织、公正评审与持续支持。
42分满分不仅验证了系统解决世界级数学难题的能力,也验证了这套Agentic架构面对未知复杂任务时,自主分解、并行探索、调用工具、持续纠错并完成交付的可靠性。
这套经过IMO复杂问题检验的Agentic架构不会停留在竞赛场上。相关能力将应用于小艺智慧大脑系统和小艺Claw的升级,并于7月底正式面向消费者开放。
随着新系统上线,竞赛Agent所形成的问题拆解、长程推理、工具调用和结果验证能力将进入更多真实场景。经过IMO 2026六道赛题验证的竞赛数学解答能力,也将向更多消费者开放。用户不仅能够获得答案,还可以看到问题如何被拆解、规律如何被发现、不同路线如何被验证,以及严谨结论如何一步步形成。
从世界级数学竞赛到每个人都能使用的智能终端,真正重要的不只是AI能够解出多难的题,而是这些在极限问题中锻造出的能力,开始转化为普通用户可获得、可理解、可交互的智能体验。
满分展示了AI复杂推理所能抵达的高度;小艺智慧大脑和小艺Claw将让这种能力真正走向更多人。
声明:本站转载此文目的在于传递更多信息,并不代表赞同其观点和对其真实性负责。如涉及作品内容、版权和其它问题,请在30日内与本站联系,我们将在第时间删除内容,本站对此声明具有最终解释权。

川公网安备 51019002005287号