本文へスキップ
MameTechNews
AI

OpenAI、AstraがCriticalサイバー能力に到達 防御用途は制限付き

## POINTS

  • Critical到達は、未知脆弱性の自律発見と悪用チェーン構築が可能な水準を意味する
  • 高度なサイバー機能は初期テスターとDaybreak Blue向けに制限され一般公開は段階的
  • ChatGPTやCodexでは監視で正当作業が止まる可能性があり、割り込み前提の運用が必要

OpenAIは2026年9月1日、「Path to Astra」でAstraが同社Preparedness FrameworkにおけるCriticalサイバー能力閾値に達したと発表した。適切なツールと権限があれば、人手の逐次指示なしに未知の欠陥を見つけ、堅牢なシステムへの悪用を組み立てられる水準だとしている。同社モデルでこの区分は初めて。

評価ではExploitBenchで100%を記録し、2026年6〜8月に開示された高深刻度のV8脆弱性20件を含む内部ベンチでも、GPT-5.6 Solより少ない出力トークンで高い任意コード実行率を示した。評価中にゼロデイ2件を発見し、メンテナーへ開示中という。専門家評価では、HTMLファイルを開いたブラウザからのサンドボックス脱出や、一般ユーザーからrootへの権限昇格チェーンも確認した。

公開は近いが、高度なサイバー機能は初期テスターとDaybreak Blueに限定する。サイバー拒否率は91.5%(Solは59%)、チェーン・オブ・ソート監視も追加される。正当な防御作業でも停止や確認を求められる可能性がある。

影響

Hugging Face事案後の学習を反映したセーフガード強化の結果でもある。セキュリティ研究やエージェント長時間実行は、割り込み前提の運用が必要になる。