由哈佛大學與麻省理工學院牽頭、OpenAI 和谷歌 DeepMind 等參與的團隊本月推出 MatrAIx 系統,可生成 83 億個 AI 智能體來模擬全球人類行爲。該系統用 1290 個維度對各類背景與生活方式的人羣建模,這些"AI 人"能像真人一樣填問卷、聊客服、刷網頁、操作 App,整體行爲一致性高達 91.5%。

91.5% 一致性,但隨場景浮動

團隊以 400 次對照測試驗證,涵蓋 10 個行爲屬性與全部四類環境,其中 366 次智能體表現出正確特質或正確抑制無關特質,即 91.5% 情形判斷準確。一致性會隨環境波動:問卷與聊天場景升至 92% 至 96%,而操控 App 測試降到 83%。

目前經確定性、質量過濾的百萬"人格核心集"已上架 Hugging Face 供研究使用,相關 8B 人格模型代碼也在 GitHub 開源。這套超大規模仿真被視爲社科與產品研究的全新試驗場,但"AI 人"能在多大程度上替代真實人類樣本,仍需更多交叉驗證。