ページを読み込み中…
ページを読み込み中…
6件の記事
Induction Labsは、アクションラベル不要で生動画から事前学習した基盤モデル「Photon-1」を発表。同モデルはデスクトップ操作やチェスプレイ、ビリヤード物理をシミュレートできる。
MLCommons は MLPerf Inference v6.1 で新ベンチ「Edge Agentic Inference」を発表し、Qwen3.6-27B を参照実装として採用した。
MarkTechPost は、長文コンテキストを持つ大規模言語モデルにおけるメモリボトルネックを解消する KV キャッシュ圧縮技術の最新動向について、TurboQuant、OSCAR、EpiCache の各手法を比較分析している。
シャオミのMiMoチームとTileRTシステムグループは、汎用GPU上で1兆パラメータ規模のモデルを秒間1000トークン超(最大約1200)で推論する新技術「MiMo-V2.5-Pro-UltraSpeed」を発表した。
KDnuggets が、機械学習モデルの圧縮技術「TurboQuant」の実効性を検証し、その性能向上が期待されたほどの価値があるかどうかを評価している。
CuTeDSLを用いたMXFP8量子化器が、Blackwell B200上で6TB/s超の処理速度を達成した。スケールファクターを直接書き込むことで、後続のGEMM処理における追加パックステップを省略し、効率化した。