ページを読み込み中…
1件の記事
AWSは、GPUの高帯域メモリへの大規模言語モデル(LLM)読み込み時間の短縮とコンテキストウィンドウの拡大を実現する技術として、Amazon FSx for LustreとTurboQuantをGPUDirectと組み合わせて活用する方法を発表した。