ページを読み込み中…
2件の記事
LLM とエージェントを用いた AutoResearch システムが仮説から論文発表までを担う過程で、どこで破綻するかを 100 の課題で体系的に診断し、既存評価の限界を指摘する。
Google は、生成 AI が事実と異なる情報を出力する「幻覚」現象を軽減するため、モデルの不確実性を評価・活用する新たな手法を検討している。この技術は信頼性の向上に寄与する可能性がある。