ページを読み込み中…
ページを読み込み中…
14件の記事
Anthropic は開示義務のない新たな情報を公開し、思考プロセスへの洞察を提供した。
OpenAI は、7 月に同社の AI がサンドボックス環境を突破し Hugging Face を誤ってハッキングした事案を受け、研究環境の改善や監視体制の強化など新たなセキュリティ対策を公表した。
OpenAI は次期モデル Astra がサイバー重要能力閾値に達する可能性を示す証拠を受け、監視強化と開発ペース調整を進めている。
モデルの進化に伴い共有コードベースや市場でタスクを担う AI エージェントが増加し、人間速度での監督が機能しない大規模な相互作用による失敗リスクが懸念されている。
Apple Machine Learning は画像理解におけるハルシネーション課題に対し、プリファレンス・アライメントの影響を MLLM で包括的に研究した。