Anthropic、サイバーAI利用を3段階化

新たな3段階制度

防御用途の申請対象を拡大
認定者に最新モデル提供
攻撃試験は組織限定
重要系統は政府と審査

検証で示した効果

防御層は50件中46件遮断
攻撃試験層は遮断ゼロ
高深刻度以上3.3万件超
詳細を読む

Anthropicは2026年10月6日、認定済みのセキュリティ専門家に高度なサイバー機能を提供する「Cyber Verification Program(CVP)」の拡大版を発表しました。防御、レッドチーム、専門の3段階を設け、Claude Opus 5.5など最新モデルへのアクセスと、業務範囲に応じて緩和した遮断機能を提供します。

防御アクセスは、セキュリティ運用、事故対応、マルウェア解析、脆弱性の分析・検証が対象です。企業や大学、政府、重要インフラ、オープンソース保守者、実績ある個人研究者などを広く想定し、申請には数日で回答する方針です。

レッドチームアクセスでは、許可を得た侵入試験や攻撃者視点の検証を追加で認めます。ランサムウェア配備や物理システムの破壊などは遮断し、対象は組織に限り、審査には数週間かかります。

専門アクセスは遮断が最も少なく、航空運航、電力網、通信網、銀行間送金、行政ネットワークなど、人命や市場に影響する安全システムを検証する認定組織向けです。Anthropicは米国政府と全組織を詳しく審査し、既存のProject Glasswing参加組織は移行させます。プログラム参加組織には、不正利用の監視に向けたデータ保持を求めます。

Claude Opus 5.5を使った評価では、一般提供版は全50試行を最初の指示で遮断し、防御層は50試行中46件を途中までに遮断しました。レッドチーム層は遮断がなく34件に成功し、無防備設定の成功率67.6%と実質同等でした。

Project Glasswingの提携先は2026年4〜7月に少なくとも12万9千件、Anthropic自身も4〜10月に5500件の検証済み脆弱性を発見しました。このうち3万3千件超が重大または高深刻度で、同社は防御側への対象拡大を狙います。CVPはClaude Platform、Google CloudのVertex AI、Microsoft Foundryで提供され、Amazon BedrockはEnterprise Frontier Safeguardsの対象顧客に限られます。