Nemotron 3 Ultra が AI Gateway で利用可能に
本文の状態
日本語全文を表示中
詳細モードで約1分の本文を読めます。
同じ出来事の情報源
この情報源を基点に整理
Vercel Blog
NVIDIA が開発したオープンな混合専門家推論モデル「Nemotron 3 Ultra」が、Vercel の AI Gateway で利用可能になりました。このモデルは最大 100 万トークンのコンテキストウィンドウを持ち、長期実行型エージェントワークフローの調整に最適化されています。
Source Article
元記事を日本語で読む
本文に関係しない購読案内、埋め込み通知、サイト内プロモーションは除いています。
Nvidia の Nemotron 3 Ultra が、Vercel AI Gateway で利用可能になりました。
Nemotron 3 Ultra は、長期実行型のエージェントワークフローをオーケストレーションするために構築されたオープンな Mixture-of-Experts(専門家混合)推論モデルで、100 万トークンのコンテキストウィンドウを備えています。このモデルは、計画策定、ツール使用、サブエージェントへの委任、エラー回復といった多段階のエージェントワークフローを対象としています。スループットは最大で秒間 350 トークンに達し、エージェントタスクにおけるコストは最大 30% 削減されます。
Nemotron 3 Ultra を利用するには、AI SDK でモデルを nvidia/nemotron-3-ultra-550b-a55b に設定してください。
AI Gateway は、モデル呼び出しの統一 API、使用状況とコストの追跡、リトライ・フェイルオーバー・パフォーマンス最適化の設定(プロバイダーの稼働率を上回る高可用性を実現)を提供します。組み込みのカスタムレポート機能、ゼロデータ保持(Zero Data Retention)サポート、レイテンシとコストに基づく動的なプロバイダーソートなど、多くの機能を備えています。AI Gateway はプロバイダー価格をそのまま反映し、マージンを加算せず、推論(Inference)や Bring Your Own Key (BYOK) リクエストにおいてもプラットフォーム料金を徴収しません。
AI Gateway に関する詳細情報、AI Gateway のモデルリーダーボードの閲覧、またはモデルプレイグラウンドでの試行については、こちらをご覧ください。
さらに詳しく読む
関連記事
今日のまとめ
AIデイリーブリーフで今日の重要ニュースをまとめ読み