ハーバード大学とマサチューセッツ工科大学が主導し、OpenAI やグーグルのDeepMindなども参加したチームが、この月にMatrAIxシステムをリリースしました。このシステムは、83億個のAIエージェントを生成し、世界中の人の行動をシミュレーションします。このシステムは、さまざまな背景とライフスタイルの人々を1290の次元でモデル化しており、これらの「AI人間」は本物の人間のようにアンケートに回答したり、カスタマーサポートとの会話をしたり、ウェブサイトを閲覧したり、アプリを操作したりできます。全体的な行動の一貫性は91.5%です。
91.5%の一貫性、ただし状況によって変動
チームは400回の対照テストで検証を行い、10の行動属性とすべての4つの環境をカバーしています。そのうち366回では、AIエージェントが正しい特性を示したり、関係ない特性を適切に抑制したりしていました。つまり、91.5%の状況において判断が正確でした。一貫性は状況によって変動します。アンケートやチャットの場面では92%から96%に上昇する一方、アプリ操作のテストでは83%に低下します。
現在、確定性と品質フィルタリングを経た百万の「人格コアセット」がHugging Faceに掲載されており、研究用として利用可能です。関連する8Bの人格モデルのコードもGitHubでオープンソースになっています。この大規模なシミュレーションは、社会科学および製品研究の新たな実験場と見なされていますが、「AI人間」がどれだけリアルな人間のサンプルに置き換えられるかについては、さらなる相互検証が必要です。
VIP会員