ページを読み込み中…
2件の記事
NVIDIA は融合カーネルや BF16/FP8 を活用し、GPU アーキテクチャに応じた実装方法とベンチ結果を解説した。
NVIDIA は、同社のモデルオプティマイザーツールを使用して、学習済みモデルを効率的に量子化する手法を公開した。これにより、AI 推論の速度向上とリソース削減が可能となる。