螞蟻集團 AI 安全實驗室近日正式開源大模型內生式安全護欄技術 SingProbe。該技術區別於主流的外掛式安全審覈模式,通過複用基座模型推理過程中的隱藏狀態,以不足0.5% 的額外計算開銷,實現 token 級實時風險評估,可同步完成意圖分類、安全檢測和幻覺識別任務,在醫療等高風險場景優勢突出,能在內容輸出前實施毫秒級阻斷。
目前 SingProbe 已適配29個主流大模型,是首個由大型科技企業開源的完整內生式安全技術解決方案,其開源代碼和預訓練模型已同步發佈。

螞蟻集團 AI 安全實驗室近日正式開源大模型內生式安全護欄技術 SingProbe。該技術區別於主流的外掛式安全審覈模式,通過複用基座模型推理過程中的隱藏狀態,以不足0.5% 的額外計算開銷,實現 token 級實時風險評估,可同步完成意圖分類、安全檢測和幻覺識別任務,在醫療等高風險場景優勢突出,能在內容輸出前實施毫秒級阻斷。
目前 SingProbe 已適配29個主流大模型,是首個由大型科技企業開源的完整內生式安全技術解決方案,其開源代碼和預訓練模型已同步發佈。
加拿大AI研究員克魯格警告,避免人類末日僅放緩AI研發遠遠不夠,必須立即、無限期暫停前沿AI研發,停止開發能力更強的AI。他是蒙特利爾大學助理教授、Mila核心成員,研究方向爲降低AI導致人類滅絕的風險。
蓋茨基金會未來兩年將投入10億美元推動人工智能發展,讓前沿技術惠及最貧困地區。蓋茨還就全球大模型格局、算力碳排放及中國人形機器人等話題發表看法,指出按不同衡量方式,中美目前各有四家領先大模型企業。
蓋茨基金會宣佈未來兩年至少投入10億美元推動AI普惠,併發布《目標守衛者報告》,呼籲抓住窗口期避免AI擴大貧富差距。報告提出實現普惠需解決三大問題,首要是支持所有語言,目前早期大語言模型訓練數據九成以上來自英語。
微軟CEO納德拉發佈內部備忘錄,稱AI應處於人類控制下,支持更廣泛第三方測試,強調必須花時間確保技術安全,否則將失去運營許可。微軟同步發佈37頁行爲準則,迴應行業對AI發展過快的擔憂。
9月15日,2026飛書未來無限大會在京舉辦。字節跳動CEO梁汝波表示,大模型Agent進入可用階段後,字節已整合豆包、飛書、火山引擎,聚焦工作與生產力產品,將加大企業市場投入,推動AI在組織內規模化落地。他還回顧飛書立項十年,初期由其負責技術,曾稱其爲“在字節憋得最久的產品”。