ページを読み込み中…
ページを読み込み中…
33件の記事
アリババは最大規模のモデル「Qwen3.8-Max」を発表し、深思考も推論価格で競合他社より低い「V4-Flash」を提供し、両社が中国の AI モデル競争を低コスト化へと導いている。
Cursor Research は Composer のボトルネック解消のため、MoE 通信と計算を統合したカーネル「Mixture-of-Kittens」を NVL72 向けに公開した。
vLLMが、アテンションとFFNを分離する「AFDプラグイン」を発表し、柔軟なMoE(混合専門家)モデルの推論サービスを実現した。
Poolsideが、118Bパラメータのオープンウェイト型コーディングエージェントモデル「Laguna S 2.1」をリリースした。同モデルはMoE構造を採用し、最大100万トークンのコンテキストをサポートする。
Thinkng Machines Lab は、9750億パラメータのオープンウェイト型マルチモーダルモデル「Inkling」を公開した。410 億パラメータが活性化し、最大 100 万トークンのコンテキストをサポートする。