9月3日、OpenAIは最新の先進的大規模モデルGPT-6Astraを正式に発表しました。このモデルはソフトウェアエンジニアリング、専門的な業務、科学、サイバーセキュリティなどの分野において「世代を超える飛躍」として定義されています。OpenAIの社長であるGreg Brockman氏は記者会見で、Astraの登場が業界が「汎用人工知能(AGI)時代」に入ったことを示していると明確に述べました。

その前に、このモデルの内部バージョンは数学および理論的コンピューターサイエンス分野における10の長期的な課題を成功裏に解決し、エージェントコードとサイバーセキュリティの能力において大きな進歩を遂げました。これはOpenAIのモデルの中でも初めて「準備フレームワーク」内で「重要な」サイバーセキュリティ能力のしきい値に達したものです。
技術性能とベンチマークテストにおいて、Astraは前世代および同様のモデルに対して画期的な向上を遂げています。ARC-AGI-3テストでは98.6%という非常に高いスコアを記録し、GPT-5.6Sol(7.8%)やClaude Opus5(30.2%)を大きく上回りました。FrontierMath Tier4(v2)では97.6%というスコアを取得し、同様の大規模モデルに比べて顕著に優れています。また、GPQA Diamond(96%)、DeepSWE v1.1(74.1%)、Terminal-Bench Science0.1(64.6%)、Agents' Last Exam(59.3%)、AutomationBench(41.4%)など、多数のテストでトップを走っています。
さらに、セキュリティ保護システムは大幅に強化され、モデルは不正な操作を防止するための新しいモニタリング機能を備えています。また、有害なネットワーク要求をより信頼性高く拒否できるようになりました。

VIP会員