OpenAI「GPT-6 Astra」、文書内プロンプト注入に脆弱
本文の状態
日本語全文を表示中
詳細モードで約1分の本文を読めます。
同じ出来事の情報源
この情報源を基点に整理
The Decoder
OpenAIの「GPT-6 Astra」は幻覚が減少し直接攻撃をブロックするが、文書内の隠れた攻撃には8.5%で突破されClaude Opus 5より脆弱である。
AI深層分析を開く2026年9月5日 02:25
AI深層分析
キーポイント
GPT-6 Astra の防御性能
同モデルは直接プロンプト攻撃を 99.99% ブロックし、幻覚(ハルシネーション)も前世代より減少させた。
隠された攻撃への脆弱性
AI が読み込む文書内に隠されたプロンプト攻撃に対しては 8.5% の確率で突破され、防御に隙があることが判明した。
競合モデルとの比較
同様の隠蔽攻撃に対する Claude Opus 5 は 4.8% の突破率であり、OpenAI モデルより高い耐性を示している。
重要な引用
blocks 99.99 percent of direct prompt injections
the model still gets cracked in 8.5 percent of scenarios
Claude Opus 5 does better at 4.8 percent
編集コメントを表示
編集コメント
GPT-6 Astra が直接攻撃に対して高い防御力を示す一方で、文書内埋め込み型攻撃に対する脆弱性が浮き彫りになった点は、実運用におけるセキュリティ対策の難しさを如実に物語っている。開発者は単にモデルをアップグレードするだけでなく、データ入力経路の監視や競合ベンチマークの継続的な見直しを怠ってはいけない。
Source Article
元記事を日本語で読む
本文に関係しない購読案内、埋め込み通知、サイト内プロモーションは除いています。

OpenAI の GPT-6 Astra は、先行モデルと比較してハルシネーション(幻覚)が減少し、直接的なプロンプトインジェクション攻撃の 99.99% をブロックしています。しかし、AI が読み込むドキュメントの中に攻撃が隠されている場合でも、8.5% のシナリオで依然として脆弱性が確認されています。Claude Opus 5 は 4.8% とより高い防御力を示していますが、実データを扱う自律型 AI エージェントにとって、これらの数値は依然として高い水準です。
OpenAI の GPT-6 Astra がハルシネーションを減らしつつも隠れたプロンプトインジェクションに対して脆弱であるという記事は、The Decoder で最初に公開されました。
関連記事
News to Guide
ニュースの次に確認する
発表内容を、現在の料金や仕様と照らし合わせられる関連ガイドです。
今日のまとめ
AIデイリーブリーフで今日の重要ニュースをまとめ読み