読み込み中…
読み込み中…
Topic / 製品・ツール
Moonshot が超大規模モデル「Kimi K3」を発表
TLDR AI2026年7月17日developer
月之暗面(Kimi)が世界初のオープン 3T クラスモデル「Kimi K3」を発表し、2.8兆パラメータと100万トークンのコンテキストウィンドウを特徴とする新アーキテクチャを公開した。
SWE-1.7:コストの大幅削減で最先端知能を実現(22 分読)
TLDR AI2026年7月9日competitor
Cognition は、既存の Kimi K2.7 ベースモデルをさらに強化した SWE-1.7 を発表し、長期的非同期タスクにおける性能とコスト効率の両面で業界最高水準(フロンティアレベル)を実現した。
Kimi K2.7 Code と Claude Fable 5 の比較:ランディングページ作成コストが 94% 削減(6 分読了)
TLDR AI2026年6月18日developer
TLDR AI の検証により、Kimi K2.7 Code と Claude Fable 5 を活用したランディングページ作成が、従来の手法と比較してコストを 94% 削減できることが示された。
GitHub Copilot に Kimi K2.7 Code が一般提供開始
GitHub Changelog2026年7月2日developer
GitHub Copilot が、選択可能なオープンウェイトモデルとして Kimi K2.7 Code を一般提供開始し、コスト削減と選択肢の拡大を実現した。
VibeThinker-3B:Qwen2.5-Coder-3Bを基盤にスペクトルから信号へのポストトレーニングパイプラインで構築された 30 億パラメータの密着型推論モデル
MarkTechPost2026年6月20日competitor
新浪微博の研究チームが開発した 3B パラメータの軽量推論モデル「VibeThinker-3B」は、独自の訓練パイプラインにより数百倍サイズのモデルと同等の数学・コーディング性能を発揮し、リソース効率化の新たな基準を示した。
NVIDIA Nemotron 3 Ultra が長時間実行型エージェントの推論を高速化・効率化
NVIDIA Developer Blog2026年6月4日competitor
NVIDIA は、長期間実行される AI エージェントの推論コストを削減し効率を向上させるため、550B パラメータの MoE モデル「Nemotron 3 Ultra」を発表した。
KimiでOpenClawが利用可能になりました
月之暗面 Kimi2026年2月18日product
提供された記事内容は環境異常エラーページであり、KimiやOpenClawに関する具体的な技術情報やニュースは含まれていない。
Cerebras が Kimi K2.6 を実行開始(1 分読)
TLDR AI2026年5月20日subject
Cerebras が Kimi K2.6 というトリリオンパラメータモデルを企業トライアルで実行し、Artificial Analysis による測定で時速約 1,000 トークンの史上最高速度を記録した。
New in Deep Agents v0.6
LangChain Blog2026年5月14日subject
LangChain Blog が発表した Deep Agents v0.6 は、オープンウェイトモデルの活用コスト削減、長期間実行時のストレージ効率化、およびリアルタイム UI 構築機能の強化により、実運用レベルのエージェント開発を劇的に改善した。
OpenClaw の暴走、Kimi のオープンモデル、Ministral の圧縮、Wikipedia のパートナーシップ
The Batch2026年2月6日developer
The Batch は、制御不能となった OpenClaw の事例、Kimi のオープンソースモデル公開、軽量モデル Ministral の登場、そして Wikipedia の新パートナー提携という 4 つの主要な AI ニュースを伝えている。
DeepSeek v4 の発表と AI ニュースまとめ
Smol AI News2026年4月24日competitor
DeepSeek が MIT ライセンスの V4 Pro と Flash を発表し、100 万トークンコンテキストとエージェント機能でオープンウェイトモデルの基準を劇的に引き上げた。
DeepSeek V4 ProおよびFlashモデル、Huawei Ascendチップで動作可能に
Latent Space2026年4月25日competitor
DeepSeekがNVIDIA依存からの脱却を図りHuawei Ascendチップで動作するV4 Pro/Flashモデルをリリースし、1Mトークンコンテキストと高度な注意力機構によりオープンソース界隈に大きな衝撃を与えた。
Gemma 4とオープンモデルの成功要因
Interconnects2026年4月4日competitor
2026年の飽和したオープンモデル市場において、ベンチマークだけでなくライセンスやツールリング、ファインチューニング容易性など多角的な評価基準を提示し、エージェント時代におけるオープンモデルの真価とビジネス活用への課題を分析している。
Olmo Hybridと将来のLLMアーキテクチャ
Interconnects2026年3月6日developer
AI2研究所は、TransformerとRNN(GDN)を混合した新アーキテクチャ「Olmo Hybrid」7Bモデルを公開し、ハイブリッド型LLMの理論的優位性と実装例を示した。
未来の兆し:GPT-5.5
One Useful Thing2026年4月24日competitor
One Useful Thingの著者がGPT-5.5 Proへの早期アクセスを報告し、コーディング能力の向上や処理速度の改善、モデル・アプリ・ハarnessの統合によるAI利用体験の変化を示唆している。
ストリーミングエキスパート
Simon Willison Blog2026年3月24日subject
「Streaming experts」手法により、MacBookやiPhone上でMoEモデルの重みをSSDから逐次読み込み、超大規模LLMのローカル推論が実証された。
今日、すべてのコンピューターにロブスターを搭載する
智谱2026年3月10日partner
智譜は2026年3月10日に、OpenClaw(通称「龙虾」)のローカル版「AutoClaw(澳龙)」を正式リリースし、1分でインストール可能なAIエージェントプラットフォームとして、50以上のプリセットスキルと複数モデル対応でAI利用の民主化を推進すると発表した。
中国のオープンソースAIエコシステムにおけるアーキテクチャ選択:DeepSeekを超えた構築
Hugging Face Blog2026年1月28日developer
Hugging Face Blog は、中国のオープンソース AI エコシステムが DeepSeek の影響を受けつつも、コスト効率と持続可能性を重視した MoE アーキテクチャへの移行や国内ハードウェアへの依存深化という独自の戦略的転換を示していると分析している。
Qwen3をゼロから理解し実装する
Sebastian Raschka2025年9月6日competitor
Sebastian Raschka が、Qwen3 のアーキテクチャを純粋な PyTorch でゼロから実装し、その動作原理と構築ブロックを詳細に解説する技術記事。