ページを読み込み中…
ページを読み込み中…
6件の記事
Moonshot AI が、パラメータ数 2.8 兆個の世界最大級オープンウェイトモデル「Kimi K3」を発表した。同社は計算資源ではなく記憶能力に賭ける戦略を掲げている。
MarkTechPost は、RTX 3090/4090 のような 24GB GPU で実行可能な Qwen や Gemma など、2026 年現在の最適なローカル LLM を比較し、70B モデルより 20-35B モデルが実用的だと指摘している。
Python プログラミングを学ぶ開発者向けに、効率的なコード作成に必要な 5 つの必須概念を紹介する記事です。
NVIDIAはJetsonプラットフォーム上で大規模生成AIモデルを動作させるため、メモリ効率を最適化する技術を提供し、開発者のエッジデプロイメントを支援している。
GoogleがAIの作業メモリを最大6倍圧縮する新アルゴリズム「TurboQuant」を発表したが、現時点では実験段階である。
研究者のDan Woodsが、Appleの「LLM in a Flash」技術を応用し、通常209GB(量子化後120GB)のQwen3.5-397B-A17Bモデルを48GB MacBook Pro M3 Maxで5.5+トークン/秒で動作させることに成功した。