ページを読み込み中…
ページを読み込み中…
4件の記事
Cursor Research は Composer のボトルネック解消のため、MoE 通信と計算を統合したカーネル「Mixture-of-Kittens」を NVL72 向けに公開した。
Berkeley AI Research は CUDA から MLX への移行知見を基に、Apple Silicon で FlashAttention や Mamba を高速化する手法 K-Search を発表した。
Together AIが公開したベンチマーク「ParallelKernelBench」の結果により、現在の最先端大規模言語モデルは依然として効率的なマルチGPU用カーネルコードを生成する能力に欠けていることが示された。
Vlad Feinberg氏が、GoogleやTPUを重視した視点から、フロンティアAI研究所で職を得るための準備方法を解説している。