GPT-6 AstraがCyber Capability「Critical」へ ― Capability Riskが運用課題になった
Executive Summary
OpenAIは2026年9月1日、GPT-6 Astraが同社Preparedness FrameworkにおけるCritical Cybersecurity Capabilityの閾値を満たしたと公表しました。9月3日にはAstraを広く提供するModelとしてリリースし、Critical水準に達した最初のModelと位置づけています。12
OpenAIの定義では、適切なToolとAccessがあれば、人が各Stepを指示しなくても、多数の高度に保護されたSystemで未知の脆弱性を発見し、そのExploitを開発できる水準です。同社はExploitBenchで100%を記録したことや、より新しいV8 Vulnerabilityを使ったInternal Benchmark、Expert-led Assessmentを根拠として示しています。
ただし、これはOpenAI自身のFrameworkとEvaluationによる判定であり、独立した普遍的なCapability尺度ではありません。本Libraryでは「AIが自動的にあらゆるSystemへ侵入できる」とは扱わず、Frontier Cyber Capabilityを前提にAccess、Isolation、Monitoring、Patch Capacityを設計する段階へ移ったことを重視します。
なぜ今なのか
8月時点ではAstraがCriticalへ到達する可能性が示されていました。9月に入り、OpenAI自身が追加評価を経てCritical到達を正式に判断したことで、「将来の想定」だったCapability RiskがModel Release時の実運用課題になりました。
何が確認されたのか
- AstraをOpenAI Preparedness Framework上でCriticalと評価
- ExploitBenchで100%
- 2026年6〜8月に開示されたV8 Vulnerabilityを含むInternal Benchmarkを実施
- Expert-led AssessmentでBrowser Compromise ChainやLocal Privilege Escalationを評価
- MisuseだけでなくMisalignment / Unauthorized ActionもSafeguard対象
- Internal DevelopmentではIsolation、Checkpoint Encryption、Full-trajectory Monitoring等を強化
- 9月3日にDaybreak for Frontline Defendersを発表し、防御側へのAccess拡大も開始
経営インパクト
| 観点 | 経営上の意味 |
|---|---|
| AI Governance | Model名ではなくCapability Levelに応じてAccessを変える必要 |
| Vulnerability Management | Discovery速度がPatch / Validation能力を上回る可能性 |
| Product Security | AI-assisted Vulnerability Researchを防御側でも活用する必要 |
| Access Control | High-risk CapabilityへStrong Identity / Approval / Monitoringを要求 |
| Model Security | Modelを使う環境そのもののIsolationとCredential設計が重要 |
日本企業への示唆
「生成AI利用規程」の延長だけでは不十分です。Cyber Capabilityの高いModelを利用する組織では、通常のChat用途とSecurity Research用途を分け、Identity Assurance、Tool Permission、Network Access、Target Authorization、Audit Logを一段強くする必要があります。
推奨アクション
- 利用中・導入予定ModelのCyber CapabilityをInventory化する
- High-risk Cyber用途を一般User Accessから分離する
- Authorized Target / Scopeを技術的に制約する
- Long-running AgentへNetwork / Credential / Tool境界を設ける
- AI-assisted Finding増加を前提にPatch CapacityをStress Testする
- VendorのCapability評価を自社Use CaseとIndependent Evidenceで補完する
好意的・批判的に見ると
好意的には、Critical Capabilityを隠さず公開し、防御側AccessやSafeguardを同時に拡張することは、Defender's Advantageを高める可能性があります。
慎重に見るべき点は、Critical判定の主要EvidenceがVendor自身のBenchmarkとInternal Assessmentを含むことです。数字だけを独立した客観尺度のように扱わず、対象環境・Tool・Access・Human Supportの条件を確認する必要があります。
用語解説
Critical Cybersecurity Capability
OpenAI Preparedness Frameworkで定義される高いCyber Capability水準。未知脆弱性の発見・Exploit Developmentや、高度TargetへのEnd-to-end Attack Strategyなどを評価対象とする。