7月20日,2026年国际数学奥林匹克竞赛(下称“IMO”)公布比赛结果。由上海中学邓乐言等六人组成的中国代表队拿下卫冕冠军,其中三人以42分的满分成绩获“满分金牌”。同时,小红书大模型dots-note-3.0也凭借官方评卷的满分成绩获“满分金牌”认证,超过本届金牌线13分。

这是全球首次有大模型在 IMO 官方评卷中斩获满分,也是中国模型首次与中国选手同获 IMO “满分金牌”。

打开网易新闻 查看精彩图片

IMO 是全球规模最大、水平最高的中学生数学竞赛,自1959年创办以来,每年吸引全球100多个国家和地区的最顶尖数学学子同台竞技,素有数学界的“奥运会”之称。其金牌得主中诞生了多位数学界最高荣誉“菲尔兹奖”的获得者,包括知名华人数学家陶哲轩。

中国代表队自1985年开始参加IMO,截至2025年共参加40届,累计获得191枚金牌、37枚银牌、6枚铜牌和49次个人满分,金牌数和满分成绩均位居全球前列。

打开网易新闻 查看精彩图片

由于 IMO 考题难度极高,且均为证明题,特别考验答题者的抽象思考、逻辑推理能力和论证过程的严谨性,近年来也成为检验大模型的重要场景。但此前仅有谷歌的 Gemini Deep Think模型在 2025 年的 IMO 中获得过官方评卷认可的金牌水平,完成了6道证明题中的5道,最终得分35分,与当届金牌线持平。

本届IMO于7月15日至16日在上海举行,共有来自120多个国家和地区的约685名参赛学生参加。题目涵盖代数、几何、数论和组合四个领域,每题7分,满分42分。

针对模型参赛方,组委会在每个比赛日的参赛学生考试结束后发放当日题目,并要求在规定期限内提交答卷,测试期间,严禁实施任何形式的人工干预,包括但不限于人为调整 AI 解题步骤、补充推理逻辑、提示思路、修正答案、筛选结果等。

小红书dots-note-3.0模型团队相关负责人介绍,收到题目后,模型基于智能体化的推理系统完成了证明,提交由 IMO 组委会进行专业的评卷审阅,最终 6 道题均获7分,斩获满分。

IMO的满分十分罕见。根据 IMO 官网历届数据汇总,1959年至2025年的66届比赛中,满分率约为1.37%。本届的满分率则仅为1%。

中国大模型首次在 IMO 中斩获官方认证的“满分金牌”,也为中国人工智能在高难度数学推理领域提供了新的能力坐标。IMO题目要求参赛者理解问题,并通过连续多步推理完成严格证明。这既体现了模型的逻辑思考能力,也证明了执行长程推理任务时的稳定性和自我校验能力。

据悉,dots-note-3.0模型将于近期开源,除推理能力外,模型在多模态等方面也表现优秀。