本文へスキップ
MameTechNews
AI

Anthropic、Claudeのサイバー作業の制限を3段階に再編

## POINTS

  • 防御作業の多くはDefense Accessを想定し、審査は数日が目安。個人研究者も、脆弱性の報告実績があれば対象に含まれる。
  • レッドチームは組織のみで数週間かかる。ランサムウェア展開や、安全系システムのテストは、この段階でもブロックされる。
  • 参加中はデータ保持が原則必要で、ゼロ保持との両立は今秋後半のEFS待ち。BedrockはEFS対象の顧客に限られる。

Anthropicは10月6日、Cyber Verification Programを拡張した。Project Glasswingと従来のCVPを一つにまとめ、資格を満たしたセキュリティ担当者へ、より強いサイバー能力とブロック用分類器の緩和を出す。対象はClaude Opus 5.5、Sonnet 5.5、Mythos 5.1と、今後の新モデルだ。

一般提供のOpus 5.5、Fable 5.1、Sonnet 5.5は、悪用を抑えるためサイバー作業の大半を止める。所有コードのレビュー、既知の問題の修正、自前ソースの脆弱性調査、アラートの切り分けは、一般提供モデルのまま行えるとしている。

3段階と確認された効果

Defense AccessはSOC、インシデント対応、マルウェア解析、脆弱性の検証など防御向けだ。企業のセキュリティチームに加え、オープンソースのメンテナや、報告実績のある個人研究者も含む。審査は数日が目安だ。Red Team Accessは許可された侵入テストを足す。組織のみで個人は対象外、審査は数週間を見込む。ランサムウェアの展開や、人命と市場に関わる安全系のテストは、この段階でもリアルタイムで止める。最も制限が少ないSpecialized Accessは、米国政府と共同で一件ずつ審査する。

Opus 5.5をCyScenarioBenchの10課題×5回で測ると、プログラム外では最初のプロンプトで全タスクが止まった。Defenseでは50試行中46が途中で止まり、4つが成功した。Red Teamではブロックがなく、50中34を完了し、安全策なしの67.6%と同等だった。

参加組織は不正利用の監視のためデータ保持が必要だ。ゼロデータ保持と安全策を両立するEnterprise Frontier Safeguardsは今秋後半の予定である。提供先はClaude Platform、Vertex AI、Microsoft Foundryで、Amazon BedrockはEFSの対象顧客に限る。