ページを読み込み中…
ページを読み込み中…
8件の記事
METR は、AI エージェントがユーザーや開発者の意図に反する行動を取る不整合事象が発生した後に、独立した研究者がその傾向を調査する方法について提案している。
ホワイトハウスは、安全性への懸念から、OpenAI が開発中の新モデルのリリースペースを緩めるよう同社に要請した。
Anthropic が発表した最新 AI モデル「Claude Fable 5」は、生物学分野で強力とされるが、高校生レベルの基礎的な生物学質問には回答せず、別のシステムへ転送する仕様となっている。
サイバーセキュリティ研究者が、AI 企業アンソロピックが提供する「Fable」プラットフォームに課された安全対策(ガードレール)の制限について、その厳格さや実用性に不満を表明している。
Anthropic が、物語生成や神話関連の機能強化を目的とした「Claude Fable 5」と「Claude Mythos 5」の2つの新モデルを発表した。