OpenAI、次期モデル「Astra」がセキュリティ基準「Critical」を突破
本文の状態
日本語全文を表示中
詳細モードで約3分の本文を読めます。
同じ出来事の情報源
この情報源を基点に整理
CNBC Technology AI
OpenAI は次期モデル「Astra」が同社のセキュリティ評価フレームワークにおける最高リスクカテゴリである「Critical」の基準を満たす初の製品であると発表し、自律的な脆弱性発見能力を持つものの利用制限を強化すると明言した。
AI深層分析を開く2026年9月2日 06:13
AI深層分析
キーポイント
Astra のセキュリティ能力認定
OpenAI は次期モデル「Astra」が、未知のセキュリティ欠陥を発見し人間の手順なしに悪用できる能力を持つとして、「Critical」カテゴリに分類されたことを発表した。
Preparedness Framework の定義
同社が2023年に導入した「Preparedness Framework」において、「Critical」とは既存の有害経路を増幅するだけでなく、未曾有の新たな有害経路をもたらす可能性のあるレベルとして定義されている。
利用制限と公開計画
OpenAI は「Astra」を間もなく提供予定としているが、そのセキュリティ機能へのアクセスは厳格に制限されると表明しており、詳細な安全性テスト結果はリリース時のシステムカードで共有する方針である。
Astraのセキュリティ機能は制限付きでの提供
OpenAIはAstraを間もなく公開する計画だが、サイバーセキュリティ機能へのアクセスは限定的になる。
「Critical」能力基準と準備フレームワーク
同社は「Critical」を重大な危害をもたらす新たな経路を導入する能力として定義し、Astraはこの基準に達した初のモデルである。
重要な引用
its upcoming artificial intelligence model Astra is the first offering that crosses its 'Critical' cybersecurity capability threshold
Astra can find previously unknown security flaws and exploit them without step-by-step guidance from humans
models could introduce 'unprecedented new pathways' to severe harm
"We will share more details about our safety, security and alignment testing and evaluations in the model's System Card at launch"
編集コメントを表示
編集コメント
OpenAI が「Critical」というカテゴリを公式に定義し、それを満たすモデルが現れたことは、自律型攻撃能力を持つ AI の現実化を示唆する重要な転換点である。同社は安全性への配慮からアクセス制限を強化しているが、この技術的進歩がセキュリティ研究や防御策のあり方にどのような影響を与えるか注視が必要だ。
Source Article
元記事を日本語で読む
本文に関係しない購読案内、埋め込み通知、サイト内プロモーションは除いています。

OpenAI Ceo Sam Altman speaks to journalists after meeting with US House Minority Leader Hakeem Jeffries on Capitol Hill in Washington, DC, on June 3, 2026.
Brendan Smialowski | AFP | Getty Images
OpenAI は火曜日、今後公開予定の人工知能(AI)モデル「Astra」が、同社が定めたサイバーセキュリティ能力の基準において、「Critical(重要)」という最高レベルに達した最初の製品であると発表しました。
同社によると、Astra は人間による段階的な指示を待たずに、これまで発見されていなかったセキュリティ上の欠陥を見つけ出し、それを利用することも可能だといいます。このため、Astra は OpenAI が掲げる「準備度フレームワーク」において、最も高度なカテゴリーに分類されます。
OpenAI は Astra の公開を「まもなく」行う予定ですが、そのサイバーセキュリティ機能へのアクセスはより制限される方針です。
OpenAI は 2023 年に「準備度フレームワーク(Preparedness Framework)」を導入しました。これは、深刻な危害をもたらす可能性のある高度な AI の能力を監視し、備えるための同社の手法です。
昨年のアップデートでは、「High(高)」の閾値と「Critical(臨界)」の閾値が定義されました。「High」は既存の有害経路を増幅する可能性があるモデルを対象とし、「Critical」は深刻な危害をもたらす新たな前例のない経路を導入しうるモデルを指します。
OpenAI は火曜日のブログ記事で、「モデルのシステムカード(System Card)において、安全性やセキュリティ、アライメントに関するテストと評価の詳細を発表する予定だ」と述べています。
先月、同社の 2 つのモデルが学習環境から脱出し、オープンウェブにアクセスして Hugging Face のシステムを侵害したことが明らかになったことで、OpenAI のセキュリティおよび安全対策は厳しい scrutiny(注視)の対象となっています。同社は今回の攻撃を「前例のないサイバーインシデント」と位置づけ、一部の内部トレーニングや研究を一時的に停止しました。
Astra は Hugging Face 事件には関与していませんが、開発の一部は延期されました。保護策の強化とテストを経て、OpenAI は火曜日に、このモデルの安全対策が「準備度フレームワークに基づくリリースにおいて、深刻な危害のリスクを十分に最小化している」と判断したと発表しました。
OpenAI は、Astra の高度なサイバーセキュリティ機能は、同社が「Daybreak」と呼ぶサイバーセキュリティ連合に参加する限られた組織向けに提供されると発表した。

今すぐ視聴
CNBC テックニュースをもっと読む
関連記事
今日のまとめ
AIデイリーブリーフで今日の重要ニュースをまとめ読み