Nvidia、高速化重視のオープンウェイトモデル「Nemotron 3.5 Lightning」を公開
本文の状態
日本語全文を表示中
詳細モードで約1分の本文を読めます。
Nvidia の発表によると、3.6 億のアクティブパラメータを持つモデルが OpenAI の gpt-oss-120b と同等の知能指数を記録し、サイズは 4 分の 1 に抑えられている。
Continue in AI NEW LAB
このニュースを、実務の判断につなげる
AI NEW LABで、試したことや先に確認したい条件を共有できます。まずはログインなしで読めます。
AI NEW LABで論点を見るAI深層分析を開く2026年8月12日 01:06
AI深層分析
キーポイント
極小パラメータでの高性能達成
Nvidia の発表によると、3.6 億のアクティブパラメータを持つモデルが OpenAI の gpt-oss-120b と同等の知能指数を記録し、サイズは 4 分の 1 に抑えられている。
業界最速の推論速度
同モデルは約 670 トークン/秒という驚異的な速度で動作し、比較対象の中で最も高速なモデルとして位置づけられた。
効率性への戦略的シフト
Nvidia はこの発表を通じて、モデルの規模を最大化するよりも、計算効率と推論速度を優先する戦略を明確に示した。
重要な引用
matches OpenAI's gpt-oss-120b on the Intelligence Index despite being four times smaller
at nearly 670 tokens per second, it's also the fastest model in the comparison
showing Nvidia is betting on efficiency over raw size
編集コメントを表示
編集コメント
Nvidia が公開したこのモデルは、パラメータ数を抑えつつ性能を維持する「小型化と高速化」のバランスを成功させた事例である。業界全体が巨大化から効率重視へ転換する中で、実運用におけるコスト削減と速度向上に直結する重要な指標となるだろう。
Source Article
元記事を日本語で読む
本文に関係しない購読案内、埋め込み通知、サイト内プロモーションは除いています。

Nvidia の「Nemotron 3.5 Lightning」は、アクティブパラメータがわずか 36 億個のオープンウェイトモデルです。このモデルは、サイズが OpenAI の「gpt-oss-120b」の約 4 分の 1 という圧倒的な小型化を実現しながらも、インテリジェンス指数では同社製品と同等の性能を達成しています。
推論速度は秒間約 670 トークンに達し、比較対象の中で最速を誇ります。これは Nvidia が、単なる規模の拡大ではなく、効率性を重視する戦略を採っていることを示す結果です。
原文を表示

Nvidia's Nemotron 3.5 Lightning is an open-weights model with just 3.6 billion active parameters that matches OpenAI's gpt-oss-120b on the Intelligence Index despite being four times smaller. At nearly 670 tokens per second, it's also the fastest model in the comparison, showing Nvidia is betting on efficiency over raw size.
The article Nvidia's open-weight Nemotron 3.5 Lightning prioritizes speed over maximum intelligence appeared first on The Decoder.
同じ出来事を5媒体で確認
同じ出来事を扱う別媒体の記事です。見出しと公開時刻を比較できます。
関連記事
今日のまとめ
AIデイリーブリーフで今日の重要ニュースをまとめ読み