ページを読み込み中…
ページを読み込み中…
11件の記事
FTによると、中国テック大手バイトダンスは米Anthropicの先進システムに迫る規模で、推定10兆パラメータの超大規模AIモデルを現在訓練中である。
Hugging Face Daily Papers は、統一型多モーダル事前学習における知識の流れやモダリティ間の相互作用メカニズムを解明する体系的な実験結果を発表し、4 つの主要知見を示した。
NVIDIAは、GB300 NVL72システム上でMixture of Experts(MoE)モデルの事前学習において世界最高性能を記録したと発表した。これにより大規模AIトレーニングの限界が根本的に変化する可能性がある。
KDnuggets は、事前学習済みモデルがファインチューニングを通じて新しいスキルを獲得する仕組みを初心者向けに解説している。
TLDR AI は、計算資源が豊富でデータが不足している環境では、大規模モデルの事前学習においてデータフィルタリングを行わないことが最適であることを示す新しいスケーリング研究を報告した。