最新オープンアーティファクト(第18号):Arceeの400B MoE、LiquidAIの過小評価された1Bモデル、新型Kimi、そして活発な月の予感
本文の状態
日本語全文を表示中
詳細モードで約3分の本文を読めます。
同じ出来事の情報源
この情報源を基点に整理
Interconnects
2025年1月はモデルリリースが低調だったが、DeepSeek V4やClaude Sonnet 5の公開期待が高まっている。Arceeの400B MoEやLiquidAIの1Bモデルなど、注目のオープンソースモデルが注目される中、業界は今後の活発な動向を見据えている。
Source Article
元記事を日本語で読む
本文に関係しない購読案内、埋め込み通知、サイト内プロモーションは除いています。
2025 年という記録的な年の翌月である 1 月は、オープンモデルのリリース数ではやや低調でした。依然として非常に強力かつ注目に値するモデルは多数存在しましたが、AI 業界全体としては今後登場するモデルに注目しています。DeepSeek V4 の迫り来るリリースとその印象的な能力、そしてさらに競争力のあるオープンモデルエコシステムに関する噂は無数にあります。
一般の AI 界隈では、Claude Sonnet 5 のリリースが明日にも行われるという噂が週末を通じて議論されてきました。次なる展開にワクワクしていますが、まずは触って遊べる新しいオープンモデルが多数あります。
シェアする
私たちが選ぶモデル
LiquidAI による LFM2.5-1.2B-Instruct: Liquid は、自社の 2.0 シリーズの 10T トークンから継続して事前学習を行い、最終的に 28T トークンまで到達させました。その成果が現れています!このモデル更新は私たちを驚かせました:私たちの「雰囲気テスト」では、毎日使用している Qwen3 4B 2507 Instruct に非常に近い性能を示しました。しかもこのモデルは、それよりも 3 倍以上も小さいのです!(まだより大きい)Qwen3 1.6B との直接比較でも、LFM2.5 をほぼ毎回好んで選びました。そして今回は、他のすべてのバリアントを同時にリリースしました。つまり、日本語版、ビジョンモデル、オーディオモデルです。

arcee-ai による Trinity-Large-Preview:全パラメータ数 400B、アクティブパラメータ数 13B の超スパースな MoE(Mixture of Experts)モデルです。アメリカの企業によってトレーニングされました。同社ではまた技術レポートと 2 つのベースモデルも公開しています。1 つは学習率 annealing(調整)前の「真の」ベースモデル、もう 1 つは事前トレーニングフェーズ終了後のベースモデルです。技術詳細やその動機など、さらに多くの洞察については、創業者および事前トレーニング責任者へのインタビュー記事をご覧ください。
moonshotai による Kimi-K2.5:15T トークンでの継続的な事前トレーニングが行われています。さらに、このモデルはマルチモーダルでもあります!Twitter では、より能力が低くても安価なモデルが必要なタスクにおいて、Claude 4.5 Opus の代わりに K2.5 が使用されるようになりました。しかし、K2 およびその後継モデルで知られていた文章作成能力は、コーディングやエージェント機能の強化のためにやや低下しています。
zai-org による GLM-4.7-Flash:GLM-4.7 の小型版です。Qwen3 MoE の小型版と同じサイズで、全パラメータ数 30B、アクティブパラメータ数 3B です。
LLM360 による K2-Think-V2:同社の既存モデルシリーズを基盤とした、真にオープンな推論モデルです。
Models
この号の残りの部分を読み進める中で、エコシステム全体における「ニッチ」な小型モデルの質の高さに感銘を受けました。OCR(光学文字認識)から埋め込みベクトル生成、楽曲生成に至るまで、今号にはあらゆる分野の内容が含まれており、今日必要とされるあらゆるモダリティにおいて優れたオープンモデルが存在することがよくわかります——ただ、それらを見つけるのが難しいだけです!
Read more
関連記事
今日のまとめ
AIデイリーブリーフで今日の重要ニュースをまとめ読み