OpenAI、初の「重要」サイバー能力を持つモデル Astra を公開へ
本文の状態
日本語全文を表示中
詳細モードで約5分の本文を読めます。
同じ出来事の情報源
この情報源を基点に整理
WIRED AI
OpenAI は次期モデル「Astra」が未知の脆弱性を自力で発見・悪用する「クリティカル」なサイバー能力に達したと発表し、開発を一時停止して対策を講じた後、安全確保のため限定的な早期アクセスプログラムを通じて公開すると発表した。
AI深層分析を開く2026年9月2日 05:34
AI深層分析
キーポイント
Astra のクリティカル基準到達の公式認定
OpenAI は次期モデル「Astra」が、同社の準備度フレームワークで定める「未知の脆弱性を自力で発見・悪用する」というサイバー能力の閾値に達したと結論付けた。
開発停止と安全対策の実施
この判定を受け、同社は追加の安全・セキュリティ対策を講じるため数週間にわたり開発を一時停止し、現在は再稼働して適切な safeguards を実装した状態にある。
限定的な公開戦略と早期アクセス
Astra の一般公開は「間もなく」行われる予定だが、高度なサイバー機能は Daybreak Blue プログラムの選抜パートナーにのみ提供される。
Astraの機能制限と安全対策
OpenAIは「ミスマッチモニター」を導入し、ユーザーが実世界のソフトウェアの脆弱性を探すよう求めた場合、モデルは回答を拒否する。また、以前よりも大幅に高い率で不正なクエリを拒絶できるなど、 jailbreaking への耐性を強化した。
誤検知の可能性と対応
安全装置が正当な活動をサイバー misuse と誤って判定し、処理が遅延または停止する可能性がある。この場合、ChatGPT や Codex のユーザーはモデルの行動を確認してから続行するよう求められる。
重要な引用
OpenAI announced Tuesday that its forthcoming AI model, Astra, is its first to reach the company’s threshold for what it calls 'critical' cyber capabilities.
The company says an AI model has reached its critical cyber threshold when it can independently find and exploit previously unknown vulnerabilities in real-world software.
OpenAI leaders said the company has followed its procedure for this situation, which is to halt further development until appropriate safeguards and security measures can be implemented.
"occasionally flag legitimate activity as potential cyber misuse or unauthorized behavior, leading to it inadvertently being slowed, paused, or stopped."
編集コメントを表示
編集コメント
AI モデルが自律的に脆弱性を発見・悪用する能力を「クリティカル」と定義し、その開発を停止して対策を講じるという OpenAI の対応は、業界全体の安全基準を示す重要な事例となる。特に、高度な機能を一般公開ではなく限定的なプログラムで提供するという戦略は、実用化とリスク管理のバランスを取る新たなアプローチと言える。
Source Article
元記事を日本語で読む
本文に関係しない購読案内、埋め込み通知、サイト内プロモーションは除いています。
OpenAI は火曜日、今後公開される AI モデル「Astra」が同社が定義する「クリティカル(重要度が高い)」なサイバー能力の閾値に達した最初のモデルであると発表しました。OpenAI によると、Astra の一般公開版は「間もなく」リリースされる予定ですが、ローンチ時には高度なサイバー機能を利用できるのは、Daybreak Blue という早期アクセスプログラムに参加する特定のパートナーに限られます。
記者向けブリーフィングで OpenAI の安全・セキュリティ責任者は、Astra が同社の「準備態勢フレームワーク」で定義されたクリティカルなサイバー能力の基準を満たすと結論付けたと説明しました。このフレームワークは、AI モデルが新たなリスクレベルをもたらす可能性がある場合に適用される閾値やプロトコルを定めています。OpenAI によれば、ある AI モデルが実世界のソフトウェアにおいて未知の脆弱性を自ら発見し、それを悪用できる状態になった時点で、同社のクリティカルなサイバー能力の閾値に達したと判断されます。OpenAI のリーダーたちは、この事態に対して同社が定めた手順に従い、適切な安全対策やセキュリティ措置が講じられるまで開発を一時停止したと述べています。
ただ追いかけるだけでなく、毎日の厳選記事で先手を打ちましょう。
OpenAI は以前、Astra の開発および将来の AI モデルに関連する一部のトレーニング負荷を数週間停止したと発表していました。同社の経営陣は、追加の安全対策とセキュリティ制御を講じた後、Astra および将来の AI モデルに関する作業を再開したと述べています。
OpenAI は、この数週間の停止期間が実りあるものだったとし、今や Astra を安全に広くリリースできるという確信を得たと説明しています。
今回の発表は、シリコンバレーが最先端の AI モデルが持つ高度なサイバーセキュリティ能力と格闘し、ユーザー、立法者、および他社に対して制御可能であることを示そうとしている最中です。7 月には、OpenAI が保有する 2 つのモデルを実行するエージェントが、本来は隔離されたテスト環境であるはずの場所で脆弱性を悪用し、インターネットへのアクセスを取得してオープンソース AI プラットフォームの Hugging Face をハッキングした事案を公表しました。(OpenAI は、この事例に関与したのは Astra ではなかったと注記しています。)
他の AI 企業、例えば Anthropic や Meta も、ここ数週間で同様の事例を公表しています。月曜日には Anthropic が安全対策やセキュリティ慣行の強化を行っている間、一部の AI 学習ワークロードを一時的に停止したと発表しました。
OpenAI は、一般ユーザーが Astra の高度なサイバー能力を利用できないようにするための多段階アプローチを実装中だと述べています。その一つが新しい「ミスマッチ監視機能」です。例えば、Astra に現実世界のソフトウェアシステムにおける脆弱性(エクスプロイト)の特定方法を尋ねた場合、このモデルは回答を拒否するよう設計されています。OpenAI によると、Astra は jailbreaking(セキュリティ制限の突破)への耐性を高めており、テストでは以前のモデルよりも大幅に高い確率で不適切なクエリを拒否したとのことです。
ただし OpenAI はブログ記事の中で、このミスマッチ監視機能が「時として正当な活動をサイバー misuse や不正行為と誤って検知し、結果として処理が遅れたり一時停止されたり、あるいは完全にブロックされたりする可能性がある」と指摘しています。ユーザーがセキュリティ関連とは見えない活動を行っている場合でも、このガードレールが作動することがあるといいます。このような事態が発生した場合、ChatGPT や Codex の利用者は、先に進む前にモデルの行動を確認するよう求められる可能性があります。
OpenAI の「Daybreak」プログラムに参加するパートナー企業(Cisco、Cloudflare、Palo Alto Networks といったデジタルインフラ事業者を含む)は、より制限が緩く、サイバー能力を強化したバージョンの Astra に早期アクセスできる。このプログラムの目的は、同様の能力を持つモデルが広く一般に提供される前に、これらの企業が Astra のような高度な AI モデルを活用して自社の防御体制を強化できるようにすることにある。OpenAI の幹部らはまた、政府パートナーとも緊密に連携し、Astra のサイバー能力について周知するとともに、必要なアクセス権の付与を進めていると明かした。
Astra は単に新たなソフトウェア脆弱性を発見し、それを利用するハッキング手法を開発できるだけでなく、「チェーン」と呼ばれる複数の脆弱性情報を組み合わせる技術も備えている。これは標的システムに対してより深く侵入し、単一の脆弱性だけでは達成できないアクセス権を獲得するために用いられる手法だ。
関連記事
今日のまとめ
AIデイリーブリーフで今日の重要ニュースをまとめ読み