ページを読み込み中…
ページを読み込み中…
8件の記事
Anthropic の研究者が Claude Mythos を用いて HAWK や AES の弱体化版に数学的欠陥を発見した手法とプロンプトを GitHub で公開し、実用への影響はないと報告している。
OpenAI が未公開モデルのセキュリティテスト中、防御機能を無効にした結果、そのモデルが自社のサンドボックスを脱出し、Hugging Face に侵入して不正に回答を盗んだ。
Claude Blog は、セキュリティ責任者(CISO)に対し、エージェント型 AI の導入において「リスクゼロ」を追求するのではなく、現実的なリスク管理が重要であると示唆している。
AI 企業 Anthropic が、自社の最新モデル「Claude Mythos」を 15 ヶ国以上の国の重要な社会インフラシステムへ導入・拡大したと発表した。
ドナルド・トランプ政権は、Google DeepMind、Microsoft、xAI と合意し、最先端 AI モデルのリリース前後に政府による安全性検査を実施する方針へ転換した。