ページを読み込み中…
ページを読み込み中…
6件の記事
アーステクニカが報じた記事では、AI が気象や気候モデルに急速に導入されている現状について言及し、これが真の技術的飛躍なのか単なる過剰な hype(過熱)なのかを問うている。
Anthropic が新モデル Claude Opus 4.8 を公開し、前作よりコスト削減に向けた開発も進めていると発表した。
Ars Technica AI が紹介した新研究によると、大規模言語モデル(LLM)は「これは嘘である」という明確な警告が示された場合でも、学習データ内の統計パターンに従って誤った記述を事実として吸収し、否定を無視する傾向があることが判明しました。
研究者らが大規模言語モデル(LLM)の出力における事実誤認(幻覚)と冗長性を評価・測定するための新しいガードレール手法を提案し、信頼性の向上を図っている。
OpenAI は、新しいデフォルトモデル「GPT-5.5 Instant」が内部評価により、以前のモデルと比較して事実誤認(幻覚)が 52.5%減少したと発表しました。これにより AI の信頼性向上が期待されます。
OpenAI が開発したコード生成モデル「Codex」のシステムプロンプトに、ユーザーがゴブリンに関する話題を一切行わないよう禁止する明確な指示が含まれていることが明らかになった。これは同社が特定のコンテンツフィルタリングを強化している事例を示す。