第67屆國際數學奧林匹克競賽(IMO2026)成績近日揭曉,小紅書大模型 dots-note-3.0以六道題全部答對的滿分成績斬獲金牌。這是中國大模型首次獲得 IMO 官方金牌水平認證,也是繼谷歌 Gemini 之後全球第二個達到該成績的大模型——且爲滿分,谷歌此前僅答對5/6題。

IMO 是國際數學奧林匹克競賽的簡稱,每年匯聚全球頂尖中學生,陶哲軒等半數當代菲爾茲獎得主均出自該賽事。比賽分兩天進行,每天4.5小時完成3道題,覆蓋代數、組合、幾何和數論四個方向,每題7分,滿分42分。參賽者必須寫出邏輯完整、可接受逐步審查的證明過程,這對大模型而言難度極高

image.png

谷歌 Gemini 的 IMO 之路可作爲參照:2024年首次挑戰時僅獲28分銀牌,且需先將題目翻譯成 Lean 等形式化語言,部分題目耗時數天;2025年 Gemini Deep Think 以自然語言端到端完成證明,4.5小時內解決5道題獲得金牌。數學競賽被視爲大模型智力與推理能力的試金石,而 IMO 相比常規 Benchmark 有一個獨特優勢——未知性。每屆賽題由專家命制並嚴格保密,模型無法提前針對性訓練,只能依賴實時理解、探索和嚴密推理。

本屆 IMO 金牌線爲29分,較去年35分下降6分,整套賽題得分難度明顯高於去年。29分意味着完整解決4道題再從剩餘兩題中拿1分即可進入金牌區間,而小紅書大模型 dots-note-3.0全部答對,與金牌線之間整整相差13分。

滿分成績首先證明的是 Agentic 推理系統的穩定性。模型需要讀懂自然語言條件,判斷關鍵信息,提出中間結論,並組織成完整證明,任何條件誤讀或推導跳步都會被評審直接指出。dots-note-3.0在六類不同問題中連續拿滿,意味着表現並非依賴某道題的偶然靈感。其次,模型直接以自然語言端到端處理,具備從問題理解到答案表達的完整閉環,代表其擁有可遷移的通用推理能力。

image.png

具體答題過程中,dots-note-3.0採用智能體方式,結合自然語言與 Python 代碼執行推理解題,並藉助遞歸自我批判能力審視自身論證。真正讓人驚喜的是第三題——一道組合博弈問題。常見解法是將原問題轉化爲圖論連通性問題再建立證明,而 dots-note-3.0轉用歸納法,抓住了問題最本質的結構,設計出恰到好處的歸納對象與命題。

雙 CMO 金牌得主劉涵祚評價其"正確且漂亮,結構緊湊、邏輯自然,即使放在 IMO 解答中也屬於較爲簡潔優雅的一類"。CMO 金牌得主汪千桐認爲其"簡潔明瞭而且直擊本質,每一步都順理成章,但人類選手很難想到能從這個角度切入"。

對小紅書而言,IMO 滿分是一次重要的技術亮相。過去外界對其技術認知集中在內容社區、推薦算法和內容理解,基礎模型領域的位置一直缺少公開權威的證明。IMO 滿分不一樣——42分就擺在那裏,無需複雜解釋,足以證明小紅書已具備值得行業認真審視的基礎模型能力,基礎模型領域出現了一個值得關注的新玩家。據悉,dots-note-3.0即將開源。