Claude-Security-Report

ファクトチェック検証済み

2026年5月30日にresearch-fact-check v2.0で7項目検証を実施。総合判定: ✅ 合格。軽微な確認不足5件あり(research-fact-check v2.0 で7項目検証を実施)。

Claude Security レポート

Anthropic社製 脆弱性スキャンツール — パブリックベータ以降の総合評価

作成日: 2026年5月30日
調査対象: Claude Security(旧称 Claude Code Security)
対象期間: 2026年4月30日(パブリックベータ開始)以降


1. 製品概要

項目 内容
製品名 Claude Security
開発元 Anthropic
発表日 2026年4月30日(米国時間)/ 5月1日(日本時間)
ステータス パブリックベータ(Enterpriseプラン限定)
コアモデル Claude Opus 4.7
アクセス方法 claude.ai/security またはClaude.aiサイドバー
前身名称 Claude Code Security → 改名して Claude Security
Team/Maxプラン 近日公開予定

1.1 位置づけ

Claude Securityは、コードベースをスキャンして脆弱性を特定し、ターゲットを絞った修正パッチを生成する防御型サイバーセキュリティ製品。従来のルールベース(パターンマッチング)の静的解析ツール(SAST)とは異なり、AIモデルがコードを「推論」することで、文脈依存の複雑な脆弱性を検出する。

Anthropicの内部Frontier Red Teamが、CTF大会参加、Pacific Northwest National Laboratoryとの共同研究、1年以上のストレステストを通じて培ったサイバーセキュリティ能力を、エンタープライズ顧客向けに提供することが目的。


2. 機能とワークフロー

2.1 スキャンフロー

リポジトリ選択 → スキャン実行(非同期) → 結果表示 → 修正提案 → PR生成 → マージ
  1. スキャン実行: claude.ai/security → "Start a new scan" → リポジトリ/ディレクトリ/ブランチを選択
  2. 推論ベース分析: セキュリティ研究者のようにコードを読み、データフローを追跡、コンポーネント間の相互作用を理解
  3. 多段階検証: 各検出結果を独立して検証し、誤検知をフィルタリング
  4. 結果出力: 深刻度、信頼度、影響範囲、再現手順、修正方法を記載
  5. 修正提案: "Create fix" → Claude Codeと連携してパッチ生成 → "Create PR" → 自動Pull Request

2.2 主な機能

機能 説明
文脈理解 ファイル間のデータフロー追跡、ビジネスロジック理解
多段階検証 自己検証による誤検知フィルタリング、信頼度レーティング
パッチ生成 既存コードベースのスタイルに合わせた修正提案
スケジュールスキャン 定期的な自動スキャンによる継続的モニタリング
却下理由の文書化 監査証跡の維持
エクスポート CSV / Markdown形式
Webhook連携 Slack、Jira等への自動通知
スコープ指定 特定ディレクトリ/ブランチに限定したスキャン

2.3 スキャンEffort(工数)レベル

Claude Securityではスキャン開始時にEffortレベルを2つの選択肢から指定できる。これはClaude Code CLIの5段階effort(low/medium/high/xhigh/max)とは別物で、Claude Security固有のスキャン深度設定である。

Effortレベル 英語表記 説明
普通 Standard 日常的なスキャン向け。標準的な推論バジェットで効率的に脆弱性を検出
拡張 Extended より大きな推論バジェットを割り当て、深い分析を行う。広範囲のコードベースや複雑なデータフローの追跡に適する

重要な特性:

設定画面の構成(5フィールド):

  1. Repository — 接続済みOrgからドロップダウン選択
  2. Branch — スキャン対象ブランチ
  3. Scan scope — オプション(特定ディレクトリに限定可能。例: services/api/
  4. Model — Claude Opus 4.7固定
  5. Effort — 普通(Standard)/ 拡張(Extended)

2.4 検出カテゴリー例


3. 精度・パフォーマンス評価

3.1 Anthropic公式主張

指標 数値
誤検知率 5%未満(多段階検証レイヤー経由)
従来SAST誤検知率 30〜60%(比較対象)
CVD真陽性率 90.8%(外部レビュー1,900件中1,726件が有効確認)
OSSゼロデイ発見数 500件以上(Claude Opus 4.6使用)
発見候補総数 23,019件

※注: CVD(協調的脆弱性開示)の数値はGlasswing/Mythosプロジェクトの成果であり、Claude Securityパブリックベータの実測値とは異なる。

3.2 実機スキャンレポート — Hedgineer(Daniel Avila, 2026年5月2日)

スタンドアローン製品「Claude Security」を実際のリポジトリで走らせた唯一の公開レポート。

内部モノレポをスキャンした結果:

🔗 Hedgineer: Claude Security — A Step-by-Step Walkthrough

非決定性(non-determinism)に関する重要な実測データ:

「AIによるスキャン製品が崩れ始めるのは再現性の部分である。LLMの性質上、これらのツールは非決定的 — 実行するたびに問題に異なるアプローチを取り、異なる結果を生み出す可能性がある」

Cobalt Coreの追加データ:

🔗 Cobalt.io: Where Claude's Security Scanning Falls Short

3.4 LLMスキャン実測 — Checkmarx Zero(Opus 4.6ベース)

Claude Security専用ではないが、同系列のLLMスキャン能力の実測データ:

テストケース 設定 結果 教訓
CGifライブラリ(~2,000 LoC) 集中的コンテキスト オーバーフローを特定成功 小規模・焦点を絞ったコンテキストでは有効
n8n本番リポジトリ 単一広範プロンプト トークン90%消費、8件中真陽性2件(精度25%) ガイドなしのフルスキャンは非効率・ノイズ多い
コンテキスト限定スキャン 歴史的CVE情報・特定モジュール提供 精度・関連性が大幅改善 ターゲットを絞ったコンテキストが必須

結論: 「LLMは強力な補完ツールだが、今日のセキュリティツール(SAST、DAST、IaCスキャナー)や専門家の代替にはならない。大規模コードベースでは単一プロンプトでのスキャンは回避し、コードベースをレビュー可能な単位に分解すること」

🔗 Checkmarx Zero: Learning About LLM-Based Zero-Day Hunting

3.5 業界の考察 — ISACA / Penligent

ISACA Now Blog(Richard Beck & Keith Bloomfield DeWeese):

Penligent / Anthropic Cybersecurity Tool 2026:

🔗 ISACA · Penligent

3.6 Snyk CTOの懸念

Danny Allan(Snyk CTO)の指摘:

非決定的メカニズムを決定的ガードレールとして使うことへの懸念だ。そして定義上、これらは非決定的である」

3.7 開発者コミュニティの声


4. 利用企業からのフィードバック(公式発表)

企業 コメント要約
DoorDash 深い脆弱性を正確に特定、ワークフローに直結
Snowflake 新しい高品質な知見を発見、影響前に問題を解決
Column コードのビジネスロジックを理解、スキャンから修正まで数クリック
Yuno スキャン品質が決め手、実在する問題を迅速に届ける
Hebbia チケットではなくPRに。数日ではなく数分で脆弱性を閉じた

※これらはAnthropicが公開しているカスタマー引用であり、独立検証された数値ではない。


5. 協調的脆弱性開示(CVD)実績

2026年5月22日時点:

段階 数値
発見候補 23,019件
外部セキュリティ企業がレビュー 1,900件
有効と確認(真陽性率 90.8%) 1,726件
メンテナーに報告 1,596件
メンテナーが承認 1,451件
アップストリームでパッチ適用 97件
セキュリティアドバイザリ公開 88件

代表的な発見例:


6. コスト

項目 内容
予約クレジット スキャン開始時に**$600以上**の残高が必要
実測コスト 小規模スキャンで約**$7.50**
課金モデル コードベースの規模と頻度に比例
請求表示 AdminダッシュボードでClaude Code Reviewと統合表示

7. セキュリティ懸念点と制限事項

7.1 データガバナンスリスク

「スキャン結果は『王冠の宝石』として保護すべき。漏洩すると攻撃者に事前構築済みの攻撃計画を提供することになる」
— Reddit r/ArtificialInteligence 議論より

7.2 技術的制限

7.3 コンプライアンス

7.4 Claude Code自身の脆弱性

Check Point ResearchがClaude Code自体に脆弱性を発見:


8. パートナーエコシステム

テクノロジーパートナー(Opus 4.7を既存プラットフォームに統合):

サービスパートナー(エンタープライズ導入を支援):

TrendAI(TrendMicro)はAnthropicとパートナーシップを結び、AIネイティブセキュリティを推進。


9. 業界のコンセンサスと戦略的提言

9.1 レイヤードアプローチ

SAST/SCA(ベースライン)
  → Claude Security(セマンティック深度・未知脆弱性)
    → DAST(ランタイム検証)
      → 人間による最終確認

Claude Securityは従来のSASTを置き換えるものではなく、補完するものという位置づけが業界標準の見方。

9.2 業界からの提言まとめ

  1. 置き換えるな、補完せよ: AIスキャンを補助レイヤーとして統合。ベースラインカバレッジには決定論的ルールエンジンを維持
  2. ガバナンスとランタイムに投資: AIの盲点をカバーするため、ポリシー強制、データフロー追跡、ランタイム保護にシフト
  3. 文脈が王: 盲目的なリポジトリ全体スキャンではなく、特定の脅威モデルと既知のアーキテクチャリスクにAIを向ける
  4. 検証してコード化せよ: AIの知見は仮説として扱え。手動で検証し、真陽性をSemgrep/Falco/OPAルールに変換
  5. 偽の自信を警戒せよ: 最大のリスクは見逃しではなく、AIの出力を過信すること。テスト証拠なしの修正は受け入れるな

9.3 「サイバー検証者の法則」

「AIが500の新しいロジック欠陥を見つける → 人間が450を失格させる → 50をSemgrep/Falco/OPAルールにコード化する。AIがフロンティアを押し広げる。決定論的ルールが前線を守る。」


10. 総括

10.1 現状評価

Claude Securityは2026年4月30日のパブリックベータ開始から約1ヶ月。方向性は正しいが、エンタープライズ級の信頼性・一貫性・精度を得るにはまだ初期段階

独立した定量評価は極めて少なく、実機スキャンを公開したレポートはHedgineerの1件のみ(定量データなし)。再現性テスト(Cobalt.io)では同一スキャン50回で結果が大きく変動し、LLMの非決定性が確認された。Checkmarxの実測ではガイドなしフルスキャンの精度は25%に留まったが、コンテキスト限定で大幅に改善。Anthropicの公式CVD数値(90.8%真陽性)は別パイプライン(Glasswing/Mythos)によるもので、パブリックベータの実測値とは直接比較できない。

10.2 今後の注目ポイント

  1. Team/Maxプランへの展開時期と機能差異
  2. 独立した第三者機関によるベンチマーク評価の公開
  3. 誤検知率の実測値(Anthropic主張の5%未満の検証)
  4. パートナー統合(CrowdStrike、Wiz等)の実装状況
  5. 非決定論性の改善(同一コードでの結果一貫性)

10.3 結論

Claude Securityは「AIによるセマンティック脆弱性検出」という新しいカテゴリを開拓した製品だが、現時点では**「SASTの置き換え」ではなく「補助レイヤー」**として位置づけるのが現実的。精度とコスト効率の両面で改善余地が大きく、今後の成熟度に注目が必要。


付録: AIセキュリティスキャナー全般のベンチマーク知見(Rafter 2026)

※本セクションはClaude Security単体ではなく、AIセキュリティエージェント全般に適用可能な評価方法論のまとめ。

🔗 Rafter: Benchmarking AI Code Security Agents (2026)


参考ソース

  1. Anthropic公式: Claude Security is now in public beta
  2. SecurityWeek: Anthropic Unveils Claude Security to Counter AI-Powered Exploit Surge
  3. DevelopersIO: Claude Securityで脆弱性のスキャン→検知→修正まで一気通貫にやってみた
  4. ZDNet Japan: Anthropic、「Claude Security」を発表
  5. Anthropic Red Team: CVDダッシュボード
  6. Pulse 2.0: Anthropic Launches Claude Security In Public Beta
  7. Hedgineer: Claude Security — A Step-by-Step Walkthrough(スタンドアローン実機スキャン)
  8. Cobalt.io: Where Claude's Security Scanning Falls Short(再現性テスト)
  9. Checkmarx Zero: Learning About LLM-Based Zero-Day Hunting(LLMスキャン実測)
  10. ISACA Now: Does Claude Have a Security Problem?(規制・コンプライアンス考察)
  11. Penligent: Anthropic Cybersecurity Tool in 2026(技術分析)
  12. Snyk: Why Anthropic Launching Claude Code Security Is Great News for the Industry
  13. Context Studios: Claude Code Security vs Static Analysis 2026
  14. DerScanner: Claude Code Security vs. Traditional SAST
  15. StackHawk: Claude Code Security vs /security-review: What to Know(製品比較)
  16. heise online: Claude Security — Anthropic launches vulnerability scanner for businesses
  17. BuildFastWithAI: Claude Security: How It Works, What It Finds, vs Snyk
  18. The New Stack: Anthropic's Claude Security emerges from closed preview