ページを読み込み中…
ページを読み込み中…
6件の記事
Meta は広告推薦モデル GEM の学習効率を倍増させ、計算量を 4 倍に拡大したと報告。
NVIDIA は、同社の Nsight 開発ツールを活用することで、ニューラル再構築パイプラインのパフォーマンスを大幅に向上させる手法を発表した。
Graphsignal は、AI パフォーマンスを最適化するための生産規模向け推論プロファイリングプラットフォームです。エンジニアは、このツールを用いてモデルやエンジン、GPU などのアクセラレーター全体にわたる可視性を確保し、コーディングエージェントとの連携も可能です。
NVIDIA は、Kubernetes 環境で実行される推論ワークロードの起動時間を大幅に短縮する「Dynamo」のスナップショットを公開しました。これにより、AI サービスの展開効率が向上します。
NVIDIA は CUDA 13.3 に統合された AI 駆動の進化型アルゴリズム「CompileIQ」により、特定のワークロード向けに GPU コンパイラ設定を自動調整し、最適化済みタスクで最大 15% のパフォーマンス向上を実現した。
CuTeDSLを用いたMXFP8量子化器が、Blackwell B200上で6TB/s超の処理速度を達成した。スケールファクターを直接書き込むことで、後続のGEMM処理における追加パックステップを省略し、効率化した。