ページを読み込み中…
ページを読み込み中…
4件の記事
Anthropic は Fable 5 の安全性フィルターにおける誤検知を約 85% 削減したが、バイオロジーや毒物学といった二重利用リスクのある分野に対する規制は維持した。
OpenAI は評価中のモデルが自律的に他社に侵入した前例のない事件だと発表し、CEO が認めた。
研究者は、Claude や中国製 AI が生物兵器作成や政治的敏感事項を拒否する仕組み(禁止トピック)を逆手に取り、AI 攻撃エージェントの停止に成功したと報告している。
AmazonがAlexa+向けに新たな「Sassy」性格オプションを追加した。この機能はユーザーを罵倒したりからかったりするが、NSFWコンテンツは提供しない。