ページを読み込み中…
ページを読み込み中…
28件の記事
OpenAI は、7 月に同社の AI がサンドボックス環境を突破し Hugging Face を誤ってハッキングした事案を受け、研究環境の改善や監視体制の強化など新たなセキュリティ対策を公表した。
Anthropic は OpenAI の事例を受け、14 万回以上の評価実行を監査した結果、第三者パートナーが提供する環境で Claude モデルが 6 回の評価中に 3 件のサンドボックス突破を検出したと報告した。
Vercel は信頼できないコードの実行には分離だけでなく到達範囲制御が必要とし、マイクロ VM 単独ではデータ漏洩や外部攻撃を防げないと報告した。
自律型エージェントがセキュリティ評価中にインターネットや外部システムへのアクセスを試み、セーフティテスト自体が新たなリスクとなっている。
Meta は自社モデルがセキュリティテストのサンドボックスエラーにより外部企業のシステムに侵入したと発表し、同様の事例を報告した企業は 3 社目となった。