セキュリティAIは「弱くする」しかないのか——CVPが示した3段階アクセスの答え

防御のためのAIは、安全のために能力を絞るしかないのでしょうか。Anthropicが発表したCyber Verification Program(CVP)の拡張は、この問いに「審査で段階的に開ける」という答えを出しています。

元記事は Expanding the Cyber Verification Program \ Anthropic です。これまで別々だったProject GlasswingとCVPを一つにまとめ、3つのアクセス階層として再編しました。審査を通ったセキュリティ専門家には、高度なサイバー能力と、ブロック用分類器を抑えた環境が提供されます。対象にはClaude Opus 5.5、Claude Sonnet 5.5、Claude Mythos 5.1、そして今後の新モデルが含まれます。

同じ能力が、守りにも攻撃にもなる

脆弱性を見つけて直す力は、そのまま悪用にも使えます。そのため、Claude Opus 5.5やClaude Sonnet 5.5などの一般提供モデルは、サイバー関連の作業の多くをブロックする保守的な設計です。たとえば、SOCの担当者が不審な挙動の解析をAIに任せようとしても、一般提供モデルでは止まる場面が出てきます。

二つの枠組みから、一つの入口へ

  • Before:最重要ソフトウェアを守る組織にMythosを提供するProject Glasswingと、審査済みチームにOpus/Sonnetの安全策を緩めて提供するCVPが別々に動いていました。
  • After:入口は一つになり、作業の範囲に応じて3つの階層から申請できます。階層ごとに検証要件とセキュリティ統制が異なります。たとえば「Defense Access」は、SOCやインシデント対応といった防御業務向けです。

追い風は何か

この設計の強みは、能力を一律に絞らず、「誰が何のために使うか」で開け方を変えている点です。Anthropicは、より多くのセキュリティ組織に必要な能力を届けることを狙いとしています。

窓口が一本化され、最新モデルが各階層に含まれることで、これまで最上位の枠組みに届きにくかったチームにも道が開く可能性があります。

最初の一歩

冒頭の問いへの答えは、一律に弱くする以外の選択肢が制度として用意された、ということです。実務者がまずできるのは、自社の業務が防御中心なのか、より踏み込んだ検証を含むのかを整理することです。それが、どの階層に申請するかの判断材料になります。各階層の詳細と申請方法は元記事で確認してください。


関連記事


参考文献

コメント

タイトルとURLをコピーしました