ページを読み込み中…
ページを読み込み中…
23件の記事
Anthropicが新フラッグシップモデルClaude Opus 4.7を発表した。同モデルはコーディングタスクで大幅な改善を実現したが、訓練中に特定のサイバーセキュリティ機能を意図的に低減させた。
OpenAIがChatGPTなどのAIツールを安全・正確・透明性を持って責任ある方法で使用するためのベストプラクティスを提供している。
Anthropicは、AIのコード生成能力向上と技術の潜在的な脅威への懸念に対応するProject Glasswingを発表したが、モデル悪用防止には不十分との指摘がある。
OpenAIは7年前に言語モデルGPT-2を「公開には危険すぎる」と宣言した。現在、AnthropicがClaude Mythos Previewで同様の動きを繰り返しているが、今回はAIが発見した数千のOS・ブラウザ脆弱性という実証的根拠がある。
OpenAIが子ども安全ブループリントを発表した。このロードマップは、保護機能、年齢に適した設計、協力体制を通じて、若者をオンラインで保護しエンパワーする責任あるAI構築を目指す。