AIニュース

OpenAI、次期モデル「Astra」がサイバー能力で「Critical」水準に到達の可能性 一部開発を制限

公開日: ・出典: OpenAI公式ブログ

OpenAIは2026年8月7日(米国時間)、開発中の次期フラグシップモデル「Astra」について、自律的なコーディングおよびサイバーセキュリティ関連の性能で大きな進展が確認され、社内の安全基準「Preparedness Framework」が定める最高位区分「Critical」級のサイバー能力に到達し得るとの評価結果を明らかにしました。専門家によるレビューでも同様の懸念が支持されたとしています。

「Critical」水準は、人手を介さずに堅牢な重要システムに対しあらゆる深刻度のゼロデイ脆弱性を発見・実用化できる、あるいは高レベルの目標だけを与えられた状態で堅牢な標的への新規攻撃戦略を一貫して立案・実行できる能力と定義されています。これまでの主力モデル「GPT-5.6 Sol」はひとつ下の「High」水準にとどまっていたとされ、Astraが該当基準を満たせば同社にとって初めての事例となります。

これを受けOpenAIは、隔離されたテスト環境の整備やモデルの重み保護の強化、エージェント的な用途全般を対象とした監視の導入など、高能力モデル向けのセキュリティ管理を厳格化。基準を満たさない社内での取り扱いを一部停止したとしています。今後は政府機関やAI安全性関連の団体とも連携し、Astraの能力についてさらなる検証を進める方針です。

出典: OpenAI公式ブログ

Xでシェア