Claude Mythos Preview ― AIのExploit Development能力が一段上がった4月
Executive Summary
Anthropicは2026年4月7日、Claude Mythos PreviewのCybersecurity Capability評価を公表しました。同社の内部Testingでは、Zero-day Vulnerabilityの発見だけでなく、複数の脆弱性を組み合わせたExploit、Local Privilege Escalation、Remote Code Execution等を自律的に構築できたと報告しています。1
特に重要なのは、前世代Modelではほぼ成功しなかったAutonomous Exploit Developmentが、Mythos Previewでは明確に進展したとAnthropic自身が評価した点です。一方、公開時点で同社が発見した脆弱性の99%以上は未Patchで、全結果を外部検証できる状態ではありませんでした。このため本Libraryでは、Anthropicが自社評価で観測したCapability Leapとして扱います。
なぜ今なのか
従来、AIによるVulnerability DiscoveryとExploit Developmentの間には大きな能力差があると考えられていました。Mythos Previewの報告は、その差が急速に縮まる可能性を示しています。
AnthropicはFreeBSD、OpenBSD、FFmpeg等について具体例を公表し、Project Glasswingを通じて重要Softwareを保守する組織へ限定的にModelを提供しました。
何が変わったのか
- Zero-day Vulnerabilityを自律的に探索
- VulnerabilityからExploit Primitiveを構築
- 複数のPrimitiveをEnd-to-End Exploitへ連結
- N-day VulnerabilityをWorking Exploitへ変換
- Human Expertが数週間必要と見積もる作業をHours単位で実施した例
- 大量Parallel Scanningによる探索Scaleの拡大
経営インパクト
| 観点 | 影響 |
|---|---|
| Vulnerability Management | 「公開CVEを待って直す」運用の猶予が縮む可能性 |
| Product Security | Vendor自身がAIで自社Codeを先にScanする必要性が高まる |
| Patch Capacity | 発見速度よりValidation / Disclosure / Patch速度がBottleneckになる |
| AI Governance | 高度なCyber CapabilityへのAccess Controlが重要になる |
日本企業への示唆
企業がMythos級Modelを直接利用しなくても、Software Vendorや攻撃者が同等能力を使う前提でExposureを見直す必要があります。
Internet-facing、Identity、Remote Access、Critical Softwareは、脆弱性公開後に対応を始めるのではなく、Asset Inventory、Compensating Control、Emergency Patch Processまで事前に準備する方が安全です。
推奨アクション
- Internet-facing / Identity / Critical Assetを優先Assetとして定義する
- KEV・EPSS・Exposure・Business CriticalityをPatch Priorityへ統合する
- Product Security TeamでAI-assisted Code Review / Vulnerability Discoveryを評価する
- 大量Finding発生時のTriaging Processを準備する
- Vendorの緊急Patch CapacityとDisclosure Processを確認する
- Cyber Capabilityの高いAI ModelへAccess Tierを設定する
用語解説
Exploit Development
脆弱性の存在を確認するだけでなく、実際にSecurity Controlを突破して任意Code実行等へつなげる攻撃手法を構築すること。