NVIDIA エンタープライズ参照アーキテクチャによる AI ファクトリーの構築
本文の状態
日本語全文を表示中
詳細モードで約12分の本文を読めます。
同じ出来事の情報源
この情報源を基点に整理
NVIDIA Developer Blog
NVIDIA が企業向けに提供する参照アーキテクチャにより、大規模な AI 処理基盤の効率的な構築が可能となる。これにより、AI ファクトリーの実現に向けた標準化が推進される。
Source Article
元記事を日本語で読む
本文に関係しない購読案内、埋め込み通知、サイト内プロモーションは除いています。
エンタープライズ生産性の次の波は、AI ファクトリーの上に構築されています。組織が推論、自動化、大規模なリアルタイム意思決定を可能にする エージェント型 AI システム を展開するにつれ、競争優位性はそれを支えるインフラストラクチャにますます依存しています。
成功には単なる計算能力の提供だけでは不十分です。それは、インテリジェントなエージェントをオーケストレーションし、データ転送を効率的に管理し、パイロットから本番環境まで一貫したパフォーマンスを提供できる、スケーラブルで予測可能な基盤を必要とします。NVIDIA によって支えられる AI ファクトリー は、AI に産業レベルの規律をもたらすことで、インフラストラクチャを速度、信頼性、加速されたイノベーションのための戦略的エンジンへと変革しています。
インフラストラクチャは AI の 5 つのレイヤー の一つであり、AI ファクトリーの基盤を構成しています。しかし、この基盤を構築するには、高性能なハードウェアを選択するだけでは不十分です。企業には、統合リスクを排除し、展開までの時間を短縮し、大規模化してもパフォーマンスを保証する、実証済みのアーキテクチャガイダンスが必要です。NVIDIA Enterprise Reference Architectures(Enterprise RAs)は、オンプレミス環境での展開に向けたインフラストラクチャの指針を提供し、コンピューティング、ネットワーク、ストレージ、ソフトウェア、システムコンポーネントがどのように統合されて生産準備完了の AI プラットフォームとなるかを定義しています。
Enterprise RAs を活用することで、組織は実験段階からスケーラブルな AI 運用へと移行し、産業規模で知能とビジネス成果を駆動するトークンを生成することが可能になります。NVIDIA Enterprise AI Factory validated design は、NVIDIA およびエコシステムパートナーのソフトウェアからなるフルスタックを選定・検証した設計であり、企業がエージェント型 AI ワークロード向けに AI ファクトリーを実運用するための全体像を完成させます。
NVIDIA-Certified Systems に基づき、パートナーとの協力のもと構築された NVIDIA Enterprise RAs は、企業がオンプレミスで AI ファクトリーを展開・スケールするのを支えています。これらの RAs は、GPU 数、メモリ、ストレージ、ネットワーク、観測性から、フルスタック統合(ハードウェア、ソフトウェア、オーケストレーション、監視を含む)に至るまで、あらゆる事項について詳細なエンドツーエンドのガイダンスを提供します。サーバーノードが NVIDIA-Certified になると、それらは企業向け RA クラスターの基盤となるビルディングブロックを形成します。

Enterprise RAs は AI ファクトリーの基盤を形成する
AI ファクトリー構築を開始するには、3 つの NVIDIA AI Factory 構成がコンピューティングアーキテクチャの加速に役立ちます。それらは、NVIDIA RTX PRO Servers を備えた「NVIDIA RTX PRO AI Factory」、NVIDIA HGX ベースシステム を備えた「NVIDIA HGX AI Factory」、および NVIDIA GB300 NVL72 プラットフォームに基づくラックスケールシステムを備えた「NVIDIA NVL72 AI Factory」です。それぞれは、異なる規模、インフラ要件、ワークロード、およびパフォーマンス目標で動作します。
組織は、自社の即時的なニーズに合致する構成とアーキテクチャから始め、AI への野心が拡大するにつれて拡張していくことができます。成熟した AI デプロイメントでは、さまざまな推論(inference)、トレーニング、ビジュアルコンピューティングのワークロード全体でパフォーマンスを最適化するために、前述の AI ファクトリ構成のブレンドポートフォリオが含まれることが一般的です。
NVIDIA RTX PRO AI Factory: ユニバーサルアクセラレーター

NVIDIA RTX PRO AI Factory は、2-8-5-200(CPU-GPU-NIC – E/W バンド幅)の参照構成に基づき、エンタープライズ AI 向けのモジュール化され電力効率の高い基盤を提供します。NVIDIA RTX PRO Blackwell Server Edition GPU を中心に構築されたこのアーキテクチャは、小規模から中規模のモデル推論、ファインチューニング、生成 AI、ビジュアルコンピューティング、産業用 AI ワークロード向けに最適化されています。これにより、企業は標準的なエンタープライズデータセンターの敷地内で、マルチモーダル・エージェントシステム、シミュレーション、分析、レンダリングをサポートし、AI をコアビジネスワークフローに近づけることが可能になります。
各 NVIDIA-Certified RTX PRO サーバーは最大 8 基の GPU を統合し、柔軟な空冷サーバー設計の中で高性能な AI コンピューティングを提供します。クラスター展開では、数十から数百台の GPU にスケール可能で、128 基および 256 基の GPU クラスター環境をサポートする利用可能な例があります。高速な NVIDIA Spectrum-X Ethernet ネットワークと NVIDIA BlueField-3 アクセラレーションにより、効率的な東西通信(イースト・ウエスト)と安全な南北データフロー(ノース・サウス)が実現されます。これにより、大規模なエンタープライズ AI 推論、デジタルツイン、ビジュアルコンピューティング、科学計算、データ分析の基盤が構築されます。
NVIDIA HGX AI Factory: エンタープライズ AI 向け画期的なパフォーマンス

NVIDIA HGX AI Factory の構成は、大規模企業がスケールして AI モデルのトレーニング、ファインチューニング、展開を行う際に標準化の基盤として採用するものです。これは、トレーニングと推論ワークロード全体にわたって継続的な運用とバランスの取れたパフォーマンスを実現するように設計されています。ある企業では、HGX AI Factory の設計に基づいて一部のクラスターを展開し、他のクラスターには RTX PRO AI Factory の設計を採用します。これは NVIDIA IT が社内の AI ファクトリを運営するために内部で使用している構成 です。
2-8-9-800 の参照構成に基づき、NVIDIA HGX AI Factory は、大規模言語モデルのトレーニングやファインチューニングを行う組織、あるいは高スループットの AI 推論を実行する組織向けに設計されています。これは、AI パフォーマンスと運用の簡素さを必要とするマルチユーザー企業環境において、計算能力、メモリ、ネットワーク全体で効率を維持しながら予測可能なスケールを実現します。
中核となる NVIDIA HGX B300 プラットフォームは、第 5 世代の NVIDIA NVLink および NVSwitch テクノロジーを介して接続された 8 枚の NVIDIA Blackwell Ultra GPU を統合し、各ノード内に密結合で高帯域幅の計算ドメインを形成しています。GPU あたり最大 270 GB の HBM3 メモリと、ノードあたり最大 2.1 TB の集約 GPU メモリを備えるこのプラットフォームは、大規模モデルのトレーニング、ファインチューニング、および中〜大規模パラメータを持つ AI 推論ワークロードに最適化されています。
NVIDIA ConnectX-8 SuperNIC を備えた高速な NVIDIA Spectrum-X Ethernet ネットワークは、クラスター間の東西通信において GPU あたり最大 800 Gb/s を提供し、分散トレーニングや大規模推論中のボトルネックを最小限に抑えます。
NVIDIA NVL72 AI ファクトリー:エクサスケール AI の原動力

NVIDIA NVL72 AI Factory は、最も先進的なラックスケールプラットフォームの一つです。兆規模のパラメータを持つモデルや AI 推論システムに対応する時代のために構築され、NVIDIA GB300 NVL72 システムを採用することで、ラックあたりの最高パフォーマンスを実現しつつ、計算・メモリ・ネットワークリソース全体にわたる効率を最大化します。
予測可能性や価値実現までの時間を損なうことなく、大規模な拡張性を求める組織向けに設計されています。このアーキテクチャは、大規模基盤モデルのトレーニング、ファインチューニング、高スループットマルチテナント推論、そして複雑な Agentic AI パイプラインを含む、集約的なエンタープライズ AI ワークロードに対して最適化されています。
NVL72 AI Factory は、36 個の Grace CPU と 72 個の Blackwell Ultra GPU を統合し、第 5 世代 NVLink で相互接続された、液体冷却対応のラックスケールシステムです。すべての GPU が統一された高帯域幅の NVLink ファブリックを介して互いに通信するため、このラックは単一の整合性のある計算ドメインとして機能します。この密結合設計により、通信レイテンシが最小化され、従来のクラスターアーキテクチャで一般的に見られるボトルネックが排除されます。統合された NVIDIA ConnectX-8 SuperNIC は AI トレーニングおよび推論のための高スループット東西方向トラフィックを確保し、NVIDIA BlueField DPUs は南北方向のデータフローを効率化します。これらにより、ラック全体が協調したデータセンタースケールのスーパーコンピュータとして動作することが可能になります。
NVIDIA Enterprise Reference Architectures (RAs) に基づく AI ファクトリ構成はアーキテクチャの基盤を提供しますが、信頼性を確立するのはシステムパートナーによる検証済みの実装です。当社のシステムパートナーはこれらの RAs を活用してソリューションを構築し、それらは NVIDIA Design Review Board (DRB) によって技術レビューの対象となります。このレビューでは、設計が NVIDIA が定義した基準や標準に照らして評価されます。
一部のパートナーはスタックの特定の層を検証する一方、他のパートナーはハードウェア、ソフトウェア、ネットワーク全体にわたる完全なエンドツーエンドシステムを検証します。これらの要件を満たす設計は NVIDIA 推奨ソリューションとして認定され、認定されたパートナーとその提供製品の一覧は NVIDIA Enterprise RA ドキュメント ページで確認できます。
グローバルなシステムパートナー は、小規模なパイロット展開から大規模な AI ファクトリクラスターに至るまでの様々なスケールポイントでテストされた Enterprise RA ベースのソリューションを提供しています。このエコシステムアプローチにより、企業は透明性、選択肢、そして信頼性を得ることができます。
迅速な導入と総所有コスト (TCO) の削減
Enterprise RAs はシステム工学を超え、迅速な展開と長期的な効率化のための具体的なレシピとして機能します。これらは組織が以下を行うことを支援するように設計されています:
- インフラに関する意思決定の迷いを解消する。
- 再設計サイクルと運用オーバーヘッドを削減する。
- 導入期間を数ヶ月から数週間に圧縮する。
- 利用率の最適化と長期的な TCO の削減。
- Enterprise Support を活用して稼働時間の最大化とパフォーマンスの最適化を実現します。
これらは単なる技術的なガイダンスを超え、企業が明確さと自信を持って概念実証から本番環境への移行を可能にします。NVIDIA Enterprise AI Factory 検証済み設計からのソフトウェアアーキテクチャおよび推奨事項と組み合わせることで、組織はオンプレミス型 AI ファクトリの展開に必要なフルスタックのサポートとガイダンスを得られ、価値提供までの時間を短縮し、AI を活用したビジネス革新を推進できます。
すぐに始めたいですか?
今日、システムメーカーまたはNVIDIA Enterprise RA ベースのソリューション設計を提供する専門パートナーにお問い合わせください。
- NVIDIA-Certified Systems に関するホワイトペーパーをお読みください。
- NVIDIA Enterprise RA のホワイトペーパーをお読みください。
- NVIDIA Enterprise AI Factory 検証済み設計ガイドをお読みください。
- NVIDIA-Certified Systems および NVIDIA Enterprise RA についてさらに詳しく学ぶ。
今日のまとめ
AIデイリーブリーフで今日の重要ニュースをまとめ読み