OpenAIは2026年9月1日、「Path to Astra」でAstraが同社Preparedness FrameworkにおけるCriticalサイバー能力閾値に達したと発表した。適切なツールと権限があれば、人手の逐次指示なしに未知の欠陥を見つけ、堅牢なシステムへの悪用を組み立てられる水準だとしている。同社モデルでこの区分は初めて。
評価ではExploitBenchで100%を記録し、2026年6〜8月に開示された高深刻度のV8脆弱性20件を含む内部ベンチでも、GPT-5.6 Solより少ない出力トークンで高い任意コード実行率を示した。評価中にゼロデイ2件を発見し、メンテナーへ開示中という。専門家評価では、HTMLファイルを開いたブラウザからのサンドボックス脱出や、一般ユーザーからrootへの権限昇格チェーンも確認した。
公開は近いが、高度なサイバー機能は初期テスターとDaybreak Blueに限定する。サイバー拒否率は91.5%(Solは59%)、チェーン・オブ・ソート監視も追加される。正当な防御作業でも停止や確認を求められる可能性がある。
影響
Hugging Face事案後の学習を反映したセーフガード強化の結果でもある。セキュリティ研究やエージェント長時間実行は、割り込み前提の運用が必要になる。