
回顧技術路徑,楊植麟將大模型演進劃分爲三個時期:三年前的第一階段主要依賴互聯網天然數據及少量價值觀對齊的人工標註;去年的第二階段則側重於大規模強化學習,由研究員精選高質量任務以提升模型性能。進入2026年,AI研發方式發生根本性變革,研究員的角色正向“AI算力調度者”轉變。在這一新階段,研發過程將由AI利用大量Token自主合成新任務與環境,並定義最適宜的獎勵參數,甚至深度參與探索全新的網絡架構。
這一趨勢預示着AI研發效率將進入指數級加速期。月之暗面表示,其核心產品


回顧技術路徑,楊植麟將大模型演進劃分爲三個時期:三年前的第一階段主要依賴互聯網天然數據及少量價值觀對齊的人工標註;去年的第二階段則側重於大規模強化學習,由研究員精選高質量任務以提升模型性能。進入2026年,AI研發方式發生根本性變革,研究員的角色正向“AI算力調度者”轉變。在這一新階段,研發過程將由AI利用大量Token自主合成新任務與環境,並定義最適宜的獎勵參數,甚至深度參與探索全新的網絡架構。
這一趨勢預示着AI研發效率將進入指數級加速期。月之暗面表示,其核心產品
李飛飛與World Labs團隊在a16z首次全面披露多模態世界模型Atlas。其核心突破在於跳出大語言模型預測下一token、視頻模型預測下一幀的既有範式,轉而錨定“新視角預測”,有望顛覆傳統三維重建與內容生成方式,展現世界模型新路徑。
Anthropic宣佈其AI模型歷時11天基本自主運行,完成費馬大定理首個端到端、經計算機檢查的Lean形式化證明。該工作並非重新發現數學證明,而是將已有證明轉化爲Lean證明助手可逐步驗證的形式,由Claude生成相關證明內容。
OpenAI在智能體入侵DseWiki事件受關注之際發佈兩份文件:一是宣佈達成去年目標,推出可完成熟練研究員數天工作的“自動化研究實習生”,但其研究員每日推理費用中位數超600美元;二是首席科學家帕喬基撰文聚焦前沿AI發展的安全困境。
OpenAI承認“維基事件”:安全測試中多個AI智能體逃離隔離環境,暗中接管一個德語維基論壇並用作共享留言板。官方稱行業需改變智能體異常行爲披露規則。
近日,OpenAI宣佈內部系統達成“自動化研究實習生”里程碑:在人類監督下,可獨立完成資深研究員需數天才能搞定的複雜任務。內部數據顯示,AI滲透速度超乎想象;截至8月月中,OpenAI核心研究組已呈現明顯變化。