在全球頂級 AI 數學基準 FrontierMath 上,一道懸了九年、自2017年就被拋出的"重大進展"級開放難題被拿下——而這次的功臣是 GPT-6Astra 與三位人類研究員的人機組合。題目問的是批准式委員會選舉裏"核是否爲空",本意是尋找"核爲空"的反例,GPT-6Astra 卻反過來證明:這樣的反例根本不存在,也就是說絕對公平的委員會在任何情況下都必定存在。
更漂亮的是,模型還順手發明了一套基於"調和熵"的全新投票規則,給出多項式時間的算法,證明局部最優解就已經滿足"核"的要求。在這輪協作裏,人類負責定方向、把邏輯關,AI 則頂起知識庫、計算演練和那些跳躍式的靈感——分工像極了一個配合默契的研究組。
這是 AI 頭一回摘下"重大進展"級數學難題,意義不只是多解了一道題。它把大模型從"解題機器"的位置往前推了一格,變成了能參與發現數學規律的合作者;連維護榜單的 Epoch AI 都爲此新增了"Human + AI"狀態標籤,專門給這種人機聯名的研究成果留了位置。當數學家開始扮演"提示詞工具人"的角色,科研這條路的寫法,正在被悄悄改寫。
VIP會員