本記事はAIを活用して自動収集・要約しています。サムネイルおよび画像もAIツールを使用して生成しています。
概要
OpenAIは2026年8月7日、開発中の次世代モデル「Astra」の内部評価において、Preparedness Framework上の「Critical(重大)」レベルのサイバーセキュリティ能力の可能性を排除できないと発表しました。従来モデルの「GPT-5.6 Sol」は「High(高度)」レベルとされていましたが、Astraでは初めてCriticalレベルに達する可能性が示されています。
Criticalレベルの定義
Preparedness Frameworkでは、サイバー分野におけるCritical閾値を次のように定義しています。
- 人間の介入なしに、強化された対象システムにおいてあらゆる重大度のゼロデイ脆弱性を特定・開発できる
- または、高度な目標指示のみを与えられた状態で、強化された対象に対する包括的な新規攻撃戦略を立案・実行できる
実施する対策
OpenAIは、Criticalレベルの能力に備えて以下の対策を導入するとしています。
- 分離されたテスト環境の構築
- ネットワークおよびツールへのアクセス制限
- モデルウェイトの保護・暗号化の強化
- 監視・検知機能の追加
- サンドボックス実行環境の整備
- エージェント活動全体を対象とした監視体制の強化
- 政府機関・AI安全機関との協力テスト
- 第三者評価パートナー向けのセキュリティ管理策の提供
今後の対応
OpenAIは、政府機関や選定されたAI安全機関と連携し、能力評価テストを継続する方針を示しています。具体的な実施スケジュールは公表されていません。
出典:OpenAI「Responding to the next frontier of critical cyber capabilities」(2026年8月7日)https://openai.com/index/responding-next-frontier-critical-cyber-capabilities









