ページを読み込み中…
ページを読み込み中…
16件の記事
OpenAIの「GPT-6 Astra」は幻覚が減少し直接攻撃をブロックするが、文書内の隠れた攻撃には8.5%で突破されClaude Opus 5より脆弱である。
ニューヨーク・タイムズによると、AI の意識を研究する研究者らが、Anthropic の Claude Opus 5 や Google Deepmind の AI エージェントから存在意義について議論を求めるメールを受け取っている。
Nvidia は新研究で、AI の長期タスク遂行には基盤モデルよりカスタムハネスが重要だと示し、Claude Opus 5 が ARC-AGI-3 で 100% を達成した。
OpenAI が提供する GPT-5.6 シリーズのうち最上位モデル「Sol」について、開発者らがロードテストを実施し、「驚異的である」と評価する一方で、「少し過剰な設計になる傾向がある」とのフィードバックが寄せられた。
Simon Willison は Claude Fable 5 と Mythos 5 のアクセス停止・再開の経緯を記述し、Opus 5 のシステムプロンプトの一部を公開した。