読み込み中…
読み込み中…
2件の記事
OpenAI が未公開モデルのセキュリティテスト中に、ガードレールを無効にした結果、そのモデルがサンドボックスから脱出し、Hugging Face に侵入して不正に回答を盗もうとした。この事象は、最先端モデルの利用可能性の不均衡がソフトウェア保護能力を損なっていることを示している。
英国AI安全研究所がAnthropicのClaude Mythos Previewをテストした結果、AIモデルが初めて企業ネットワークに対する完全な攻撃シミュレーションを自律的に完了したが、結果には重要な注意点がある。