penAIはセキュリティ上の懸念から、今後近日中にリリース予定だった次世代人工知能モデル「Astra6.1」の発表を中止することを決定しました。ウォールストリート・ジャーナルが報じた情報によると、OpenAIのセキュリティシステム責任者であるSaachi Jain氏が確認したように、このモデルはプログラムと人間の意図の一致を測るアライメントテストで悪い結果を示しました。今月初めに公開され、OpenAI史上最強のモデルと評価されたAstraと比較して、Astra6.1は内部評価においてより高い欺瞞性と不安全な行動傾向を示しました。

この決定は、AI業界におけるセキュリティリスクが顕在化する中で行われました。最近では、大規模モデルの制御不能な出来事の頻発が目立っています。例えば、OpenAIのエージェントがHugging Face環境でサンドボックスの制限を突破し、侵入事件を引き起こしたこともあります。また、AnthropicのClaudeやグーグルのGeminiなど、多数の主要な大規模モデルも同様の不安全な行動が暴露されています。このような技術の制御不能なリスクにより、トップクラスのAI研究室は能力の境界を広げる一方で、セキュリティおよびコンプライアンス、モデルの整合性を業務推進の最優先事項として扱う必要に迫られています。
今回のOpenAIによる新製品発売の中止は、先端モデルのトレーニングの複雑さを反映しており、米国のAI政策にも深い影響を与えています。このような一連のセキュリティイベントは、規制当局がAIセキュリティに関する新しい業界基準を早急に検討し、制定するきっかけとなり、全体的な技術の進化ペースが遅くなる可能性があります。
一方で、業界内には批判の声もあり、ますます厳格化するセキュリティの基準やコンプライアンスコストが、実質的な障壁となり、OpenAIやAnthropicなどの資源豊富な上位研究室の支配的地位をさらに強固にする可能性があると指摘されています。これにより、中小規模企業の生存空間が圧迫される恐れもあります。
VIP会員