ページを読み込み中…
ページを読み込み中…
5件の記事
Anthropic が新モデル「Claude Sonnet 5」を発表し、その性能や特徴について解説している。
TLDR AI が紹介する「Agent Judge」は、検索・検証・適応に焦点を当て、従来の LLM 判定器が苦手とする長期コンテキストや状態保持アクションの評価精度と一貫性を向上させる手法です。
AI プラットフォーム「Together AI」が、中国の企業「DeepSeek」が開発した最新モデル「V4 Pro」の利用を開始した。これにより開発者は同プラットフォーム上で高性能な大規模言語モデルを直接利用できるようになった。
Anthropic社が、Opus 4.6とSonnet 4.6モデルで100万トークンのコンテキスト長を標準価格で一般提供開始した。競合のOpenAIやGeminiは長いコンテキストに対して追加料金を課しているが、Anthropicは追加料金なしで提供している点が特徴。
マルチ画像推論の能力を評価するための新しいベンチマーク「ビジュアル・ヘイスタック」が発表されました。