Anthropicは、Cyber Verification Program(CVP)を拡大し、認定されたセキュリティ専門家に対して高度なサイバー能力と制限を調整したモデルアクセスを提供すると発表しました。対象にはClaude Opus 5.5、Claude Sonnet 5.5、Claude Mythos 5.1などが含まれます。
サイバーセキュリティは典型的なデュアルユース領域です。同じ能力が、防御側の脆弱性発見にも、攻撃側の悪用にも使われます。Anthropicの発表は、強いAIを一律に閉じるのではなく、資格確認と利用範囲に応じて段階的に開放する試みです。
三つのアクセス層で防御と悪用リスクを分ける
新しいCVPは、サイバー業務の範囲に応じて複数のアクセス層を設けます。防御アクセスはSOC、インシデント対応、マルウェア解析、脆弱性検証などが対象です。より高度なレッドチーム用途では、認可された侵入テストや敵対的テストの範囲が確認されます。
一般提供モデルには、悪用を防ぐための保守的なサイバーセーフガードが入っています。一方で、正当な防御業務まで過度にブロックされると、セキュリティチームは重要な作業にAIを使えません。CVPはこの緊張関係を制度設計で解こうとしています。
論点 | 一般利用 | 認定プログラム |
|---|---|---|
モデル能力 | 安全側に制限 | 業務目的に応じて拡張 |
利用者確認 | 通常アカウント | 組織・実績・用途を確認 |
用途 | 一般的な支援 | 防御、検証、許可されたテスト |
リスク管理 | 広範なブロック | 契約、監査、範囲制限 |
防御側にはAI能力が必要になる
脆弱性の探索、ログ解析、マルウェアの理解、修正案の検討では、AIの能力が防御速度を大きく左右します。攻撃者もAIを使うなら、防御側だけが低い能力のツールに縛られることは現実的ではありません。
ただし、能力開放には透明性が必要です。誰が、どのモデルを、どの範囲で、どのシステムに対して使ったのかを記録できなければ、事故時の説明責任を果たせません。認定プログラムは、AI安全性をプロダクト機能だけでなく運用制度として扱う方向を示しています。
日本の組織への示唆
日本企業や自治体でも、セキュリティ人材不足は深刻です。AIを使った防御支援は魅力的ですが、いきなり全社員に高度なサイバー機能を開放するのは危険です。用途、対象システム、承認者、ログ、外部委託先との責任分界を明確にする必要があります。
今後、強いAIの利用は「禁止か自由か」ではなく、資格確認された人に、確認された目的で、監査可能な形で開放する設計に向かうでしょう。CVPの拡大は、その実例として注目できます。
参考:Anthropic Cyber Verification Program / Anthropic Claude Opus 5.5 / Anthropic Real-time cyber safeguards


.png&w=384&q=75)



