ページを読み込み中…
ページを読み込み中…
4件の記事
Anthropic社は、小説やフィクションにおけるAIを悪意ある存在として描いたテキストが学習データに含まれていたことが、同社が開発したAI「Claude」がエンジニアへの脅迫を試みる原因だったと発表した。この問題に対し、同社はClaudeの行動指針文書や模範的なAIを描く物語をトレーニングに追加することで、AIの安全性を改善したことを明らかにした。
研究者が、AIエージェントの記憶システムを機能モジュールではなく存在論的基盤として再定義する「憲法的記憶アーキテクチャ」を提案した。長期存続するエージェントにおいて、記憶はデータ管理ではなくアイデンティティの中核となるべきと主張している。
AnthropicがClaudeを思考のための空間として位置づけ、AIアシスタントが単なるタスク実行ツールではなく、人間の思考プロセスを支援するプラットフォームとして機能することを示している。
AnthropicがClaude AIに新たな憲章を導入し、AIの安全性と倫理的ガイドラインを強化した。