コンテンツにスキップ

Claude Mythos Preview ― AIのExploit Development能力が一段上がった4月

Executive Summary

Anthropicは2026年4月7日、Claude Mythos PreviewのCybersecurity Capability評価を公表しました。同社の内部Testingでは、Zero-day Vulnerabilityの発見だけでなく、複数の脆弱性を組み合わせたExploit、Local Privilege Escalation、Remote Code Execution等を自律的に構築できたと報告しています。1

特に重要なのは、前世代Modelではほぼ成功しなかったAutonomous Exploit Developmentが、Mythos Previewでは明確に進展したとAnthropic自身が評価した点です。一方、公開時点で同社が発見した脆弱性の99%以上は未Patchで、全結果を外部検証できる状態ではありませんでした。このため本Libraryでは、Anthropicが自社評価で観測したCapability Leapとして扱います。

なぜ今なのか

従来、AIによるVulnerability DiscoveryとExploit Developmentの間には大きな能力差があると考えられていました。Mythos Previewの報告は、その差が急速に縮まる可能性を示しています。

AnthropicはFreeBSD、OpenBSD、FFmpeg等について具体例を公表し、Project Glasswingを通じて重要Softwareを保守する組織へ限定的にModelを提供しました。

何が変わったのか

  • Zero-day Vulnerabilityを自律的に探索
  • VulnerabilityからExploit Primitiveを構築
  • 複数のPrimitiveをEnd-to-End Exploitへ連結
  • N-day VulnerabilityをWorking Exploitへ変換
  • Human Expertが数週間必要と見積もる作業をHours単位で実施した例
  • 大量Parallel Scanningによる探索Scaleの拡大

経営インパクト

観点 影響
Vulnerability Management 「公開CVEを待って直す」運用の猶予が縮む可能性
Product Security Vendor自身がAIで自社Codeを先にScanする必要性が高まる
Patch Capacity 発見速度よりValidation / Disclosure / Patch速度がBottleneckになる
AI Governance 高度なCyber CapabilityへのAccess Controlが重要になる

日本企業への示唆

企業がMythos級Modelを直接利用しなくても、Software Vendorや攻撃者が同等能力を使う前提でExposureを見直す必要があります。

Internet-facing、Identity、Remote Access、Critical Softwareは、脆弱性公開後に対応を始めるのではなく、Asset Inventory、Compensating Control、Emergency Patch Processまで事前に準備する方が安全です。

推奨アクション

  1. Internet-facing / Identity / Critical Assetを優先Assetとして定義する
  2. KEV・EPSS・Exposure・Business CriticalityをPatch Priorityへ統合する
  3. Product Security TeamでAI-assisted Code Review / Vulnerability Discoveryを評価する
  4. 大量Finding発生時のTriaging Processを準備する
  5. Vendorの緊急Patch CapacityとDisclosure Processを確認する
  6. Cyber Capabilityの高いAI ModelへAccess Tierを設定する

用語解説

Exploit Development
脆弱性の存在を確認するだけでなく、実際にSecurity Controlを突破して任意Code実行等へつなげる攻撃手法を構築すること。

関連記事

参考情報