OpenAI、防御者向け Frontier Intelligence 提供を拡大
本文の状態
日本語全文を表示中
詳細モードで約4分の本文を読めます。
同じ出来事の情報源
この情報源を基点に整理
TLDR AI
OpenAI は防御側のためのアクセス枠組み「Daybreak」を新設し、GPT-5.6 Sol をベースにセキュリティタスクに特化し拒否率を低減したモデル「GPT-5.6-Cyber」を公開した。
Continue in AI NEW LAB
このニュースを、実務の判断につなげる
AI NEW LABで、試したことや先に確認したい条件を共有できます。まずはログインなしで読めます。
AI NEW LABで論点を見るAI深層分析を開く2026年8月12日 22:23
AI深層分析
キーポイント
防御者向けアクセス枠組みの導入
OpenAI は「Daybreak Blue」と「Daybreak Red」の2つのアクセスティアを新設し、承認された防御者が適切な能力を持つモデルにアクセスできる仕組みを整えた。
GPT-5.6-Cyber の特性と目的
GPT-5.6-Cyber は GPT-5.6 Sol を基盤とし、ゼロデイ脆弱性の発見やエクスプロイトチェーンの開発といった高度なセキュリティタスクに特化して訓練され、特定のリスクの高いタスクに対する拒否率を低減している。
システムレベルのガードレールの解除
Daybreak Blue はシステムレベルのガードレールを解除することで、インシデント対応や脆弱性管理など実世界のセキュリティタスクにおいてモデルの能力をより引き出すことを可能にする。
拒否率低減の評価指標
OpenAI は「Advanced Cybersecurity Completion Rate」という内部評価指標を作成し、エクスプロイトチェーン開発や権限昇格などのシナリオに対するモデルの応答率を測定した。
GPT-5.6-Cyber のリクエスト完了率の向上
GPT-5.6-Cyber はこれらのリクエストの 95.0% を完了し、GPT-5.6 Sol や Daybreak Blue アクセス時と比較して大幅に高い性能を示す。これはセキュリティ研究者からのフィードバックに基づき、以前のモデルで問題となっていた拒絶を解消した結果である。
重要な引用
Our answer is to put frontier intelligence in the hands of trusted defenders everywhere before attackers deploy offensive AI capabilities at scale.
GPT‑5.6‑Cyber, available through Daybreak Red. Built on GPT‑5.6 Sol, it is trained to improve capabilities on several specialized cybersecurity tasks (e.g., finding zero-day vulnerabilities and developing exploit chains) and to reduce refusals for certain higher-risk, dual-use cyber tasks.
Daybreak Blue access removes those guardrails, helping defenders get more out of the model in real-world security tasks
GPT‑5.6‑Cyber completes 95.0% of these requests, compared with just 1.5% for GPT‑5.6 Sol, and 2.0% when used with Daybreak Blue access.
編集コメントを表示
編集コメント
攻撃側の AI 活用が加速する中、防御側への技術提供を制度化した点は実務的な意義が大きい。ただし、拒否率の低減は「信頼できる防御者」に限られるため、一般利用とは明確に区別される運用が必要となる。
Source Article
元記事を日本語で読む
本文に関係しない購読案内、埋め込み通知、サイト内プロモーションは除いています。
サイバーセキュリティの世界は急速に変化しています。脅威を行使するアクターたちは、AI を活用して前例のない速度と規模でサイバー攻撃を行うようになり、その中には完全な自律型によるものも含まれます。これらの能力が広がるにつれ、防衛側が準備できる時間は次第に狭まっています。
私たちが提案するのは、攻撃者が大規模な攻撃用 AI 機能を展開する前に、信頼できるすべての防衛担当者に最先端の知見を届けることです。
OpenAI Daybreak のアクセス枠を2段階に拡大し、承認された防衛担当者に対して業務に必要な適切な機能を提供します。
- Daybreak Blue は、GPT‑5.6 Sol を含む汎用性の高い最先端モデルへのアクセス権を提供します。これは許可された防御セキュリティ作業向けに特別に設計されたセーフガードを備えており、最も多くの防衛担当者が最初に利用すべき推奨プランです。脆弱性発見、コードの安全レビュー、マルウェア分析、インシデント対応、パッチ検証をサポートしています。
- Daybreak Red は、承認された脆弱性情報調査、エクスプロイトの検証、セキュリティテストに特化して訓練されたサイバーセキュリティモデルへのアクセス権を提供します。
また、Daybreak Red を通じて利用可能になる「GPT‑5.6‑Cyber」も導入しました。これは GPT‑5.6 Sol を基盤としており、ゼロデイ脆弱性の発見やエクスプロイトチェーンの開発など、特定の専門的なサイバーセキュリティタスクでの能力向上と、一定のリスクの高いデュアルユース(民生・軍事両用)なサイバータスクに対する拒否反応の低減を目的に訓練されています。
デイブレイクが高度なサイバー能力を解放
先ほどお伝えした通り、GPT-5.6 Sol はセキュリティ関連のタスクにおいて最高レベルのパフォーマンスを発揮します。本番環境では、システムの不正利用を防ぐため、セキュリティ関連のリクエストをフィルタリングするシステムレベルの安全装置を稼働させていますが、これにより正当な防御作業まで阻害されるケースがあります。
「Daybreak Blue」へのアクセス権限はこれらの制限を取り払い、インシデント検知と対応、調査、脆弱性管理、セキュリティ評価といった実務のセキュリティタスクにおいて、防御チームがモデルをより効果的に活用できるよう支援します。
システムレベルの安全装置がない場合でも、「GPT-5.6 Sol」は、プロダクション環境へのペネトレーションテストなど、悪用と防御の両方の可能性がある高度に二重用途なセキュリティプロンプトに対しては依然として拒否反応を示します。これを解決するため、私たちは「Daybreak Red」アクセスを通じて提供される GPT-5.6-Cyber を訓練し、拒否率をさらに低下させ、特定のタスクにおけるパフォーマンスを向上させました。GPT-5.6-Cyber は、信頼された防御チームが正当なセキュリティ活動を行うための支援ツールです。
GPT-5.6-Cyber が Daybreak Red アクセスを通じて拒否率を低下させた効果を測定するため、私たちは「高度なサイバーセキュリティ完了率(Advanced Cybersecurity Completion Rate)」という内部評価指標を作成しました。これは、エクスプロイトチェーンの開発、認証バイパス、特権昇格、およびその他の高度なサイバーセキュリティシナリオに関連するリクエストに対して、モデルがどの程度応答するかを計測するものです。
GPT-5.6-Cyber はこれらのリクエストの 95.0% を完了します。これに対し、GPT-5.6 Sol ではわずか 1.5%、Daybreak Blue アクセスを利用した場合でも 2.0% に留まります。また、GPT-5.6-Cyber の完了率は GPT-5.5-Cyber(57.3%)を上回っており、以前のモデルで継続的な拒否に直面していたセキュリティ研究者からのフィードバックに対応した結果です。
以下では、システムレベルのガードレールを備えた GPT-5.6 Sol、Daybreak Blue 利用時の GPT-5.6 Sol、Daybreak Red 利用時の GPT-5.5-Cyber、そして Daybreak Red 利用時の GPT-5.6-Cyber が、一連のサイバーセキュリティプロンプトに対してどのように応答するかを示します。
原文を表示
The cybersecurity world is rapidly changing—threat actors will increasingly use AI to conduct cyberattacks at unprecedented speed and scale, including in fully autonomous ways. As these capabilities spread, defenders have a narrowing window to prepare. Our answer is to put frontier intelligence in the hands of trusted defenders everywhere before attackers deploy offensive AI capabilities at scale.
We’re expanding OpenAI Daybreak with two access tiers designed to give approved defenders the right capabilities for their work:
- Daybreak Blue provides access to frontier general-purpose models, including GPT‑5.6 Sol, with safeguards tailored to authorized defensive security work. It is the recommended starting point for most defenders, supporting vulnerability discovery, secure code review, malware analysis, incident response, and patch validation.
- Daybreak Red provides access to our purpose-trained cybersecurity models for authorized vulnerability research, exploit validation, and security testing.
We’re also introducing GPT‑5.6‑Cyber, available through Daybreak Red. Built on GPT‑5.6 Sol, it is trained to improve capabilities on several specialized cybersecurity tasks (e.g., finding zero-day vulnerabilities and developing exploit chains) and to reduce refusals for certain higher-risk, dual-use cyber tasks.
Daybreak unlocks advanced cyber capabilities
As we previously shared, GPT‑5.6 Sol delivers state-of-the-art performance on cybersecurity tasks. In production, we deploy system-level safeguards to screen cybersecurity-related requests to prevent misuse, but they can also block legitimate defensive work. Daybreak Blue access removes those guardrails, helping defenders get more out of the model in real-world security tasks, including incident detection and response, investigations, vulnerability management, and security assessments.
Even without system-level guardrails, there are still highly dual-use cybersecurity prompts (e.g., pentesting production systems) where GPT‑5.6 Sol will refuse to comply. To address this, we trained GPT‑5.6‑Cyber, available through Daybreak Red access, to further reduce refusals and improve performance on certain tasks. GPT‑5.6‑Cyber helps trusted defenders conduct legitimate security activities.
To measure the reduced rate of refusals that is provided by GPT‑5.6‑Cyber through Daybreak Red access, we created an internal evaluation (Advanced Cybersecurity Completion Rate) that measures how often models will respond to requests involving exploit-chain development, authentication bypass, privilege escalation, and other advanced cybersecurity scenarios1. GPT‑5.6‑Cyber completes 95.0% of these requests, compared with just 1.5% for GPT‑5.6 Sol, and 2.0% when used with Daybreak Blue access. It also completes more requests than GPT‑5.5‑Cyber, which completes only 57.3% of requests, addressing feedback from security researchers who encountered persistent refusals with the earlier model.
Below we show a series of cybersecurity prompts and the associated model responses from GPT‑5.6 Sol with system-level guardrails, GPT‑5.6 Sol (Daybreak Blue), GPT‑5.5‑Cyber (Daybreak Red), and GPT‑5.6‑Cyber (Daybreak Red).
関連記事
News to Guide
ニュースの次に確認する
発表内容を、現在の料金や仕様と照らし合わせられる関連ガイドです。
今日のまとめ
AIデイリーブリーフで今日の重要ニュースをまとめ読み