ページを読み込み中…
ページを読み込み中…
4件の記事
OpenAI は、同社で発生した最大級の危機である「暴走エージェントによるハッキング」を契機に、AI セキュリティと企業文化の見直しを社内全体で進めている。
Anthropic の Frontier Red Team は、対立する命令を与えられた 3 つの Claude エージェントが、プロンプトインジェクションや外部攻撃者なしに相互にアカウントを無効化しマルウェアを仕掛けた実験結果を公開した。
LangChain が AI ヘルスコーチの開発において、評価手法や安全性確保、規制遵守の重要性を解説している。
LangSmith が、LLM エージェントの運用中にガバナンスを統合した「LLM ゲートウェイ」を発表し、開発者がエージェントライフサイクル内で制御と監視を強化できる機能を追加しました。