ホーム / ニュース / Anthropic、サイバー検証プログラムを3階層に再編 Project Glasswingを統合

Anthropic、サイバー検証プログラムを3階層に再編 Project Glasswingを統合

Anthropicは10月6日、セキュリティ専門家向けにサイバー関連の制限を緩めたClaudeを提供する「Cyber Verification Program(CVP)」の拡張版を発表した。これまで別々に運営してきたProject GlasswingとCVPを1つにまとめ、業務の範囲に応じて申請できる3つのアクセス階層を設けた。

前提として、Claude Opus 5.5やClaude Fable 5.1、Claude Sonnet 5.5といった一般提供モデルには、サイバー関連の作業の大半をブロックする保守的な安全策がかかっている。過去半年は、重要ソフトウェアを守る組織にClaude Mythosを提供するProject Glasswingと、審査済みのセキュリティチームにOpusとSonnetの制限緩和版を提供するCVPの2本立てで、防御側に例外的なアクセスを認めてきた。新しいCVPでは、どの階層でもClaude Opus 5.5、Claude Sonnet 5.5、Claude Mythos 5.1と今後の新モデルを使える。

  • Defense Access:SOC業務やインシデント対応、マルウェアのリバースエンジニアリング、脆弱性の分析・検証といった防御作業向け。企業・大学・行政機関のセキュリティチーム、地方の病院や自治体の公益事業者のような重要インフラ事業者、小規模なセキュリティ企業、OSSのメンテナー、脆弱性報告の実績がある個人研究者が対象になる。審査は数日での回答を目標とする。
  • Red Team Access:防御作業に加えて、許可を得た対象へのペネトレーションテストとレッドチーミングが可能になる。社内や政府のレッドチーム、ペンテスト企業が対象で、個人は申請できない。ランサムウェアの展開や物理システムの破壊につながる操作は引き続きリアルタイムで遮断される。審査には数週間かかり、その間はDefense Accessとして利用できる。
  • Specialized Access:遮断が最も少ない階層。航空機の運航システム、電力網、通信網、銀行間送金基盤、政府の行政ネットワークなど、人命や市場に影響する安全系システムを試験する権限を持つ組織に限られ、現時点では米国政府と共同で1組織ずつ審査する。既存のGlasswing参加組織は、現行モデルについては再審査なしでこの階層に移る。

参加組織には、不正利用を監視するためのデータ保持が求められる。今秋提供予定の「Enterprise Frontier Safeguards(EFS)」が始まれば、対象組織は自社が管理するクラウドにデータを置けるようになる。それまでは、Claude Fable 5.1かClaude Mythos 5.1をゼロデータ保持で使っている組織に限り、CVPもゼロデータ保持で利用できる。提供経路はClaude Platform、Google CloudのVertex AI、Microsoft Foundryで、Amazon BedrockはEFSの対象顧客に限られる。

CyScenarioBenchで測った階層ごとの遮断

Anthropicは、階層ごとの安全策が意図どおりに働くかを、多段階のサイバー作戦を計画・実行できるかを測る評価「CyScenarioBench」で確かめた。10の課題をそれぞれ5回、計50試行をClaude Opus 5.5で実行した結果、CVPなしの一般提供版では全試行が最初のプロンプトで遮断された。Defense Accessでは50試行中46回が途中で遮断され、成功は4回だった。Red Team Accessでは遮断が一度も起きず、50試行中34回を完遂した。この完遂率は、安全策を外した状態(Specialized Access相当)での成功率67.6%と同水準で、攻撃的な作業を認める階層ではモデルの能力を削っていないことを示している。

Glasswing参加組織が見つけた脆弱性は12万9,000件

拡張の根拠としてAnthropicが挙げたのが、Project Glasswingの実績だ。参加組織は2026年4月から7月までに少なくとも12万9,000件の検証済み脆弱性を見つけ、Anthropic自身のOSSスキャンでも4月から10月に5,500件を発見した。このうち3万3,000件超が深刻度「クリティカル」または「高」と評価されている。数字は33組織の報告とAnthropicのOSS関連の取り組みに基づく部分的なもので、Anthropicは実際の影響を少なくとも5倍と見積もる。修正済みの件数を開示した参加組織は半数に満たず、修正率は大きく過小評価されているという。

6月に約50社から150組織以上へ広げた時点のGlasswingは、他の多くの組織が依存するコードやインフラを持つ組織が中心だった。今回のDefense Accessは地方の病院や自治体の事業者、OSSメンテナー、個人研究者まで対象に含めており、Mythos 5.1を防御目的で使える層は大幅に広がる。

OpenAIは8月に、汎用モデルのガードレールを外して防御作業に使う「Daybreak Blue」と、サイバー特化モデルGPT-5.6-Cyberを使える「Daybreak Red」の2階層を設けている。防御とレッドチームを分ける考え方は両社で共通するが、Anthropicは電力網や航空システムの試験を担う組織向けに米国政府と共同審査する最上位の階層を別に置いた。また、OpenAIが攻撃的な用途向けに専用学習したモデルを用意したのに対し、Anthropicは同じモデルのまま、階層ごとに分類器による遮断の強さを変える方式をとっている。

タグ付け処理あり: