Anthropicは10月6日、セキュリティ専門家向けの「サイバー検証プログラム(CVP)」を拡大すると発表しました。利用者や用途を審査した上で、Claudeのサイバーセキュリティ機能に対する制限を段階的に緩和します。
防御・レッドチーム・特別アクセスの3段階
新たなCVPでは、利用目的などに応じて3段階のアクセスレベルを設定します。
「Defense Access」は、インシデント対応やマルウェア解析、脆弱性分析など防御目的の業務が対象。「Red Team Access」では、許可されたシステムへの侵入テストやレッドチーム活動まで利用範囲を広げます。
さらに、電力網や通信ネットワーク、銀行間送金インフラなど重要なシステムのセキュリティテストを担う一部の検証済み組織には、サイバー関連のブロックを最も少なくした「Specialized Access」を提供します。
一方、ランサムウェアの展開や物理システムの損傷など、大規模な被害につながる可能性がある操作については、Red Team Accessでもリアルタイムでブロックするとしています。
Anthropicによる評価では、Claude Opus 5.5を使った50回の試行のうち、Defense Accessでは46回が途中でブロックされました。一方、Red Team Accessではブロックは発生せず、50タスク中34タスクを完了したとしています。
見解として、今回注目したいのは、生成AIの能力を「使える・使えない」の二択で管理するのではなく、利用者の審査や目的、リスクに応じてアクセス範囲を変える仕組みです。AIが高度化するほど、企業にはモデル性能だけでなく「誰に、どこまで使わせるのか」という権限設計が求められます。CVPは、高性能AIと安全性をどう両立するかを考える一つの事例といえそうです。
詳しくは、Anthropic「Cyber Verification Program」まで。
レポート/DXマガジン編集部





















