
技術層面,
在安全性與準確性上,新模型較 GPT-5.2的單個陳述錯誤率降低了33%,整體回覆錯誤率下降18%。此外,針對推理模型可能存在的“思維鏈欺騙”風險,
在實測基準測試中,
Mercor 首席執行官 Brendan Foody 指出,該模型在金融、法律等專業領域的


技術層面,
在安全性與準確性上,新模型較 GPT-5.2的單個陳述錯誤率降低了33%,整體回覆錯誤率下降18%。此外,針對推理模型可能存在的“思維鏈欺騙”風險,
在實測基準測試中,
Mercor 首席執行官 Brendan Foody 指出,該模型在金融、法律等專業領域的
OpenAI CEO奧爾特曼證實推進機器人研發,並行佈局人形機器人與數據中心特種機器人。他強調形態並非關鍵,核心是“機器人大腦”;公司會研發人形機器人,但若人形結構缺乏實際效用,將針對特定場景開發非擬人機器人。
9月3日,OpenAI發佈前沿大模型GPT-6Astra,稱其在軟件工程、專業工作、科學及網絡安全等領域實現“代際飛躍”。總裁Greg Brockman表示,這標誌行業邁入通用人工智能(AGI)時代。此前內部版本已解決數學與理論計算機科學領域10個長期難題,並在代理編碼與網絡安全能力上取得重大突破。
OpenAI推出“Daybreak for Frontline Defenders”全球計劃,未來6個月投入10億美元,爲預算與安全人員不足的機構提供Daybreak訪問、培訓及技術支持,助其用AI抵禦網絡威脅,優先覆蓋供水、電力、地方政府和金融等關鍵公共服務領域,並啓動“Daybreak for America”作爲組成部分。
9月3日,全球AI領域遭遇罕見集體故障,OpenAI的ChatGPT、Grok、Claude等主流大模型幾乎同時大規模宕機,大量用戶日常使用和工作流受影響。故障波及頭部大模型平臺,引發業界和用戶高度關注,技術團隊已緊急排查搶修。
OpenAI發佈超旗艦大模型GPT-6 Astra,總裁布羅克曼稱其或標誌着人類邁入通用人工智能(AGI)時代。該模型在數學與科學測試中實現代際躍升,FrontierMath Tier4和GPQA Diamond分別達97.6%和96%,動手能力等表現亦突出。