在2026年国际数学奥林匹克竞赛(imo)官方特别邀请下,华为小艺ai竞赛agent正式参与这一全球最具权威性的中学生数学赛事。历经连续两天高强度比拼与多轮严谨评审,该系统成功攻克全部六道高难度赛题,最终以42分满分成绩达成金牌标准。
这一突破性成果充分体现了小艺Agent在代数、几何、数论及组合数学等核心数学领域的系统性解题能力,也标志着华为在复杂问题建模、长距离逻辑推理、多工具协同调度以及形式化验证等关键技术方向取得实质性进展。
IMO主席Gregor Dolinar教授评价道:
“Congratulations! The solutions from HUAWEI have achieved a perfect score of 42 points on the problems of the 67th International Mathematical Olympiad.”
“祝贺!华为提交的解答在第67届国际数学奥林匹克竞赛中斩获42分满分。”

一、超越满分:AI正以全新范式突破数学求解边界
IMO2026的六道题目覆盖数论、平面几何、对抗性博弈、函数方程与递推结构等多个经典且前沿的数学分支。真正引发广泛关注的,并非仅是小艺AI完成了全部题目,更在于其展现出一种区别于人类数学家的认知路径——AI无需复刻人类直觉,亦能抵达新的解题疆域。
人类解题常依赖一条高度凝练的逻辑主线,辅以关键节点上的顿悟式突破;而Agentic系统则更接近一支高效运转的数学研究小组:多个专业化Agent可同步开展猜想生成、路径试探、反例构造与引理验证,并依据实时反馈动态优化资源配置。这标志着AI正从“Copilot式辅助应答”,迈向“Agent级自主闭环任务执行”的新阶段。
例如,在第3题与第4题所涉及的组合博弈类问题中,系统部署了角色分工明确的Agent集群:策略设计者提出初始方案,模拟对手进行对抗推演,裁判Agent则调用代码执行器完成穷举验证与反例挖掘,形成“猜想提出—环境仿真—反例攻击—策略迭代”的完整闭环。那些对人类而言稍纵即逝的灵感火花,在AI系统中被转化为可重复实验、可精确追踪、可结构化验证的对象。
针对第2题的几何证明任务,系统并未孤注一掷于某一种方法,而是并行启动纯几何法、复数表示法、解析坐标法与符号代数推导四条路径。各Agent分别识别图形不变量、压缩代数关系、校验关键恒等式,再由Verifier模块进行跨方法交叉核验。人类追求的是最简明优美的单一证明,AI则让多种数学语言共同“表决”,显著降低因早期路径误判导致的整体失败风险。
对于第5题与第6题这类需构建长链逻辑的深度证明题,系统依托持续演化的“证明状态图”,实时记录已确立引理、子任务依赖关系、已发现反例及失效路径。探索型Agent负责开辟新思路,子问题分解Agent专注攻克局部难点,Verifier持续扫描逻辑断点,调度Agent则根据成功率与信息增益动态分配算力资源。当某条路径受阻时,系统可精准回溯至最近稳定节点,而非从头开始。
因此,IMO2026的满分并非单纯源于模型参数规模的增长,而是对一种新型智能范式的实证:它具备研究团队般的协作机制、程序般的确定性执行、审稿人般的批判性检验,以及实验室般的记忆与迭代能力。
二、满分是里程碑,更是通向现实应用的关键跃迁
华为小艺AI团队诚挚感谢IMO组委会的专业统筹、公平评审与长期支持。
42分满分不仅印证了系统应对世界级数学挑战的卓越能力,更验证了该Agentic架构在面对未知复杂任务时,所展现的自主任务拆解、多线程探索、工具链调用、持续容错修正及端到端交付的工程可靠性。
这套经IMO六道高维赛题严苛锤炼的Agentic技术框架,不会止步于竞技舞台。其核心能力将深度融入小艺智慧大脑系统与小艺Claw平台,并计划于7月底面向广大消费者全面开放。
随着新版本上线,源自竞赛场景的问题结构化解析、长程因果推理、外部工具协同调用及结果可信验证等能力,将逐步下沉至真实用户场景。经过IMO2026全题组验证的数学问题求解体系,也将向公众开放使用。用户不仅能获取最终答案,更能直观看到问题如何被逐层拆解、规律如何被系统识别、不同解法路径如何被评估比较,以及严谨结论如何经由多重验证层层构建而成。
从全球顶级数学赛场走向日常智能终端,真正具有变革意义的,不只是AI能否解开艰深难题,而是这些在极限压力下淬炼出的能力,正在转化为普通人可接触、可感知、可交互的智能服务体验。
满分,标定了AI复杂推理所能企及的新高度;小艺智慧大脑与小艺Claw,则让这份能力真正触达每一个人。



















