小红书大模型IMO 2026满分夺金,自然语言解法获冠军选手盛赞
2026/07/22 08:34阅读量 24
小红书大模型dots-note-3.0在2026年国际数学奥林匹克(IMO)中六题全对,以满分42分获得金牌,成为中国首个获IMO官方金牌水平认证的大模型,也是继谷歌Gemini后第二个达成此成绩的模型。模型全程使用自然语言解题,第三题创新采用归纳法,被多位CMO金牌得主评价为“漂亮且优雅”。该模型即将开源。
事件概述
小红书旗下大模型dots-note-3.0在2026年国际数学奥林匹克(IMO)中六道题全部答对,以满分42分的成绩获得金牌。这是中国大模型首次获得IMO官方金牌水平认证,也是继谷歌Gemini模型之后全球第二个达到该成绩的大模型(谷歌去年仅答对5/6题)。
核心信息
- 成绩细节:模型六题全对,满分42分。2026年IMO金牌线为29分(去年35分),满分与金牌线相差13分,显示今年赛题难度更高,满分含金量更大。
- 解题方式:模型仅用自然语言完成读题、解析到写证明的全过程,未借助形式化语言。采用智能体方式,结合自然语言与Python代码执行推理,并具备递归自我批判能力来审视自身论证。
- 创新解法:第三题(组合博弈问题)模型未采用常见的图论转化方法,而是使用归纳法,抓住问题最本质的结构,CMO金牌得主汪千桐评价其“简洁明了、直击本质”,双CMO金牌得主刘涵祚称其“结构紧凑、逻辑自然”。
- 技术意义:该成绩证明模型具备稳定的Agentic推理系统、可迁移的通用推理能力,以及对未知问题的创新求解能力。
- 后续动作:小红书表示该模型即将开源。
值得关注
- 赛制与难度:模型同步参与当届IMO,赛题严格保密,无法提前训练;官方按正式标准评卷。2026年金牌线下降6分,说明本届试题更难,满分更具说服力。
- 行业影响:此次成绩是小红书在基础模型领域的一次重要技术亮相,此前外界对其技术认知多集中在内容社区和推荐算法层面。IMO满分证明了小红书具备值得行业审视的基础模型能力。
- 对比:谷歌Gemini在2024年首次挑战IMO仅获银牌(28分),2025年Gemini Deep Think以自然语言端到端方式获金牌(5/6题)。小红书dots-note-3.0实现满分,且全部使用自然语言。
