ITBEAR科技资讯
网站首页 科技资讯 财经资讯 分享好友

小红书大模型dots-note-3.0 IMO满分摘金:中国AI首获认证,解法获双冠军盛赞

时间:2026-07-22 13:57:44来源:互联网编辑:快讯

在国际数学界极具权威性的第67届国际数学奥林匹克竞赛(IMO)成绩公布后,引发了广泛关注。中国大模型小红书 dots - note - 3.0在此次竞赛中表现惊艳,以六道题全部答对的满分成绩斩获金牌,这不仅是中国大模型首次获得IMO官方金牌水平认证,更是全球继谷歌Gemini之后第二个达到该成绩的大模型,且谷歌此前仅答对5/6题。

IMO作为全球顶尖中学生汇聚的数学盛会,每年都吸引着众多数学精英参与,像陶哲轩等半数当代菲尔兹奖得主都曾是该赛事的参赛者。竞赛分两天进行,每天要在4.5小时内完成3道题,题目涵盖代数、组合、几何和数论四个方向,每题分值为7分,满分42分。参赛者必须给出逻辑完整、能够经受逐步审查的证明过程,这对于大模型来说,难度堪称极高。

回顾谷歌Gemini的IMO征程,可作为此次竞赛的一个参照。2024年,谷歌Gemini首次挑战IMO时,仅获得28分,获得银牌,而且在解题过程中,需要先将题目翻译成Lean等形式化语言,部分题目耗时数天。到了2025年,谷歌Gemini Deep Think实现了自然语言端到端完成证明,在4.5小时内解决了5道题,从而获得金牌。数学竞赛向来被视为检验大模型智力与推理能力的“试金石”,而IMO相较于常规的Benchmark,有一个独特之处——未知性。每届赛题都由专家精心命制并严格保密,大模型无法提前进行针对性训练,只能依靠实时理解、探索和严密推理来解题。

本届IMO的金牌线为29分,相较于去年的35分下降了6分,由此可见整套赛题的得分难度明显高于去年。29分意味着参赛者需要完整解决4道题,再从剩余两题中拿到1分就能进入金牌区间。而小红书大模型dots - note - 3.0全部答对,与金牌线之间相差整整13分,这一成绩令人瞩目。

dots - note - 3.0获得满分成绩,首先证明了其Agentic推理系统具有极高的稳定性。在解题过程中,模型需要准确读懂自然语言条件,精准判断关键信息,提出合理的中间结论,并将其组织成完整的证明,任何一个环节出现条件误读或推导跳步,都会被评审直接指出。该模型在六类不同问题中都能连续拿满分数,说明其表现并非依赖于某道题的偶然灵感。其次,模型直接以自然语言端到端处理题目,具备从问题理解到答案表达的完整闭环能力,这代表着它拥有可迁移的通用推理能力。

在具体答题过程中,dots - note - 3.0采用了智能体方式,结合自然语言与Python代码执行推理解题,并且借助递归自我批判能力审视自身论证。其中,第三题是一道组合博弈问题,常见解法是将原问题转化为图论连通性问题后再建立证明,而dots - note - 3.0却另辟蹊径,转用归纳法,抓住了问题最本质的结构,设计出恰到好处的归纳对象与命题。

这一精彩的解答得到了双CMO金牌得主刘涵祚的高度评价,他认为“正确且漂亮,结构紧凑、逻辑自然,即使放在IMO解答中也属于较为简洁优雅的一类”。CMO金牌得主汪千桐也表示“简洁明了而且直击本质,每一步都顺理成章,但人类选手很难想到能从这个角度切入”。

对于小红书来说,此次IMO满分成绩是一次重要的技术展示。过去外界对小红书的技术认知主要集中在内容社区、推荐算法和内容理解方面,其在基础模型领域的实力一直缺乏公开权威的证明。而此次IMO满分成绩,42分的成绩清晰明了,无需过多解释,足以证明小红书在基础模型领域已经具备了值得行业认真审视的能力,成为基础模型领域一个值得关注的新力量。据悉,dots - note - 3.0即将开源。

更多热门内容
小红书就IPO传闻作出回应:网传递表及上市受阻消息均不实
近期,关于社交平台小红书的上市传闻引发市场广泛讨论。有消息称,该公司已于6月底前秘密提交IPO申请,但因前员工举报合规问题导致进程受阻。此类未经证实的传言在资本圈持续发酵,引发各方关注。针对沸沸扬扬的市场猜测,小红书官方于7月22日通过媒体渠道明确回应,称当前流传的所有关于公司启动IPO的信息均不属实。这一表态直接否定了近期围绕其上市计划的多重猜测。

2026-07-22