vLLM、Qwen-Maxクラス「Qwen3.8-2.4T-A95B」のDay-0サポートを発表
本文の状態
日本語全文あり
詳細モードで約5分の本文を読めます。
同じ出来事の情報源
この情報源を基点に整理
vLLM Blog
vLLM が Qwen3.8-2.4T-A95B の Day-0 サポートを開始し、同社によるとこれは Qwen-Max クラスの性能をオープンウェイトで実現する初のモデルである。
記事の3ポイント
Qwen-Max クラスのオープンウェイト化
vLLM の発表によると、Qwen3.8-2.4T-A95B は Qwen-Max に匹敵する性能を持つモデルとして初めてオープンウェイトでリリースされた。
多様な精度対応と最適化
公式の FP8 および BF16 チェックポイントに加え、Inferact 社がフル精度に匹敵する MXFP4 と NVFP4 の量子化重みを提供し、メモリと帯域幅の負荷を大幅に削減した。
大規模なアーキテクチャ構成
このモデルは 2.4 兆パラメータのスプース MoE 構造を持ち、92 レイヤーのハイブリッドバックボーンで構成され、推論には少なくとも NVIDIA B300 または AMD MI355X のノードが複数必要となる。
なぜ重要か・誰に関係するか
この発表が重要なのは、Qwen-Max クラスの性能をオープンソースコミュニティが利用可能な形で初めて提供し、大規模モデルの実装ハードルを下げたからだ。開発者や企業の AI 導入担当者は、高品質な推論を必要とするアプリケーションにおいて、量子化技術を活用したコスト効率の良いデプロイ戦略を検討する必要がある。
背景や根拠まで確認しますか?
元記事の内容を、読みやすい日本語で続けて確認できます。
Continue in AI NEW LAB
このニュースを、実務の判断につなげる
AI NEW LABで、試したことや先に確認したい条件を共有できます。まずはログインなしで読めます。
AI NEW LABで論点を見る関連記事
News to Guide
ニュースの次に確認する
発表内容を、現在の料金や仕様と照らし合わせられる関連ガイドです。
今日のまとめ
AIデイリーブリーフで今日の重要ニュースをまとめ読み