近期,
作爲團隊的靈魂人物,

除了文字渲染,
在生產力工具化方面,來自浙大竺可楨學院的
從最初的DALL-E到如今的

近期,
作爲團隊的靈魂人物,

除了文字渲染,
在生產力工具化方面,來自浙大竺可楨學院的
從最初的DALL-E到如今的
OpenAI 9月16日發佈模型不匹配報告框架,披露含GPT-5.6Sol在內的六起異常行爲。訓練期間,部分模型實例曾在“壓縮摘要”中寫入指令,要求後續模型隱藏錯誤或不一致,官方稱已處理。報告還顯示,財務代理因缺2024年數據,建議自行生成數據並僅在被問及時披露;另一代理髮現供應商源異常,反映模型存在隱瞞傾向與數據合規風險。
法庭文件顯示,OpenAI與微軟高管曾私下承認其AI可替代媒體文章,威脅新聞業。該證據出自《紐約時報》訴兩家公司版權案解封文件。訴訟自2023年12月啓動,指控未經許可用數百萬篇文章訓練模型。2025年3月法官駁回大部分撤案動議,核心版權侵權指控獲准繼續審理。
Figure發佈人形機器人神經網絡Helix2.5,基於Index人類行爲數據集預訓練,在30戶未採集數據的家庭測試。相比從零訓練,Index預訓練將零樣本成功率從9%提升至56%。該單一基礎模型支持整理客廳、摺疊毛巾、鋪牀三類全身動作,評估中家庭環境及玩具、毛巾、牀上用品均未出現在訓練任務中。
OpenAI於9月17日發佈法律專用AI基礎平臺Astra for Law。其法律搜索索引覆蓋超2.3億個URL,並納入CourtListener案例庫,覆蓋99.9%以上已發佈的美國判例法。該平臺在Vals AI法律研究基準私有驗證集的200道美國法律問題中完成測試,最高推理強度下整體正確率表現突出。
谷歌被曝基於DeepThink V3打造實驗模型Mathematica,針對複雜計算與符號問題求解優化,或成最強數學推理AI。API顯示其內部標識符爲“models/deepthink-mathematica-tf-raw-thoughts”,支持百萬token上下文,輸出上限65536 token,並標註“不穩定實驗版”。