読み込み中…
読み込み中…
Topic / 企業・研究機関
中国製オープン大規模モデル3種を比較
MarkTechPost2026年7月19日developer
Moonshot AI、DeepSeek、Zhipu AI の 3 つの中国発オープンモデルがトリリオンパラメータ規模で競合し、ベンチマークとコスト構造における新たな基準を提示した。
OpenAI、GPT-5.6 で推論コストを制御可能に
Sebastian Raschka2026年7月18日competitor
Sebastian Raschka は、OpenAI の GPT-5.6 シリーズで採用された「推論努力設定」の概念を解説し、従来の LLM を多段階の推論モードを持つモデルへ転換する具体的な手法と技術的意義について詳述している。
中国 Moonshot AI が超大規模モデル「Kimi K3」発表
Simon Willison Blog2026年7月17日competitor
中国の Moonshot AI が世界最大級の 2.8 トリオンパラメータを持つ「Kimi K3」を発表し、ベンチマークと価格設定において業界トップクラスに位置づけられる一方、オープンウェイト化は 2026 年まで延期されるという重要な動向が示された。
ビデオ編集タスク向けの意図解析・グラフ計画・ツールルーティングを備えた VideoAgent スタイルのマルチエージェントシステムの構築
MarkTechPost2026年7月14日developer
本記事は、LLM を活用したマルチエージェントシステム「VideoAgent」の構築チュートリアルを提供し、意図解析からグラフ計画、ツールルーティングに至るまでの実装コードと、FFmpeg や Whisper を組み合わせた具体的な動画編集ワークフローを公開している。
オープンウェイトモデルの利用が 29% に急増、トークン単価は横ばい
Vercel Blog2026年7月13日developer
Vercel の 2026 年 7 月データによると、オープンウェイトモデルの利用率が急増し市場シェアを拡大している一方で、高リスク業務におけるクローズドモデルへの依存は依然として強く、全体としてのトークン単価は横ばいを維持している。
オープンモデルはあと6ヶ月で存続の危機
Interconnects2026年7月13日subject
ホワイトハウスによる新たな大統領令の検討や、中国発オープンモデルの台頭を背景に、次期6ヶ月以内に高能力オープンモデルへの規制または禁止措置が実施される可能性が高まっている。
米国の輸出規制に対応し、中国のDeepSeekが独自チップ開発へ
TLDR AI2026年7月8日developer
米国の輸出規制への対応として、中国のAIスタートアップDeepSeekがNvidiaやHuaweiへの依存を減らすため、推論用チップの開発に着手したことが報じられた。
米輸出規制に対応、中国の DeepSeek が独自チップ開発へ
Ars Technica AI2026年7月8日developer
米国の輸出規制を回避し、Nvidia や Huawei への依存を脱却するため、中国の DeepSeek が推論用チップの開発に着手した。
「初の AI 実行型ランサムウェア攻撃」にも人間が関与していたことが判明
TechCrunch AI2026年7月7日competitor
Sysdig が報告した初の「AI 実行型ランサムウェア」攻撃において、技術的実行は AI エージェントが担ったものの、標的選定やインフラ構築など戦略的指揮は人間が行っていたことが判明し、実態の全貌が明らかになった。
Sakana AI、Namazu搭載の和英中翻訳ツール「Sakana Translate」を公開
MarkTechPost2026年7月6日developer
Sakana AI は、日本語特有の敬語や文化背景を深く理解する「Namazu」モデルを搭載した翻訳ツール「Sakana Translate」を公開し、単なる単語置換を超えた文脈・トーン維持を実現した。
美团发布长猫 2.0:1.6 兆パラメータのオープン MoE モデルがネイティブ 100 万トークンコンテキストと長猫スパースアテンションを実現
MarkTechPost2026年7月6日competitor
美团が、100 万トークンのコンテキストウィンドウと 1.6 トリオンパラメータを備えたオープン MoE モデル「LongCat-2.0」を発表し、国内 AI ASIC 環境での大規模トレーニング成功とエージェントコーディングへの特化を明らかにした。
Qwen の元リーダーが「ハイブリッド思考」の誤りと、なぜ今「エージェント」を支持するのか
MarkTechPost2026年7月5日competitor
アリババの元Qwen技術責任者であるJunyang Lin氏は、ハイブリッド思考モードの実装における根本的な課題を指摘し、現在は「モデルの訓練からエージェントの訓練へ」というパラダイムシフトを強く支持する立場へと転換した。
今日は何も大きな出来事はありませんでした
Smol AI News2026年6月19日competitor
GLM-5.2 の登場により、オープンウェイトモデルがクローズドモデルに匹敵するコーディング能力を獲得し、業界の戦略的価値観とインフラ要件に変化が生じている。
DeepSeek が LLM 推論を最大 85% 高速化する新フレームワーク「DSpark」をオープンソース化
TLDR AI2026年6月30日developer
DeepSeek が MIT ライセンスで公開した推論高速化フレームワーク「DSpark」は、スペキュレーティブ・ディコーディングの精度を向上させ、LLM の応答速度を最大 85% 改善する画期的な技術である。
アーティファクト22:Zyphra、Cohere、Poolsideがエコシステムの多様化を拡大
Interconnects2026年6月29日developer
Interconnects は、オープンモデル開発が特定の中国企業や大手テックに偏らず、多様なニッチ企業や主権 AI プレイヤーによって支えられつつある生態系の変化と、その規制への懸念を分析している。
DeepSeek、DeepSeek-V4 の生成速度を 60〜85% 向上させる推測的デコーディングフレームワーク「DSpark」を公開
MarkTechPost2026年6月28日developer
DeepSeek は推論速度を劇的に向上させる新しい推測デコーディングフレームワーク「DSpark」およびトレーニングコード「DeepSpec」をオープンソース化し、既存モデルの生成速度を最大 85% 加速する成果を発表した。
百度、長文解析向け KV キャッシュを一定に保つ 3B モデル「Unlimited OCR」を発表
MarkTechPost2026年6月25日competitor
百度は、KV キャッシュのサイズを一定に保つ新しい「Reference Sliding Window Attention」を採用した 3B モデル「Unlimited OCR」を発表し、長文ドキュメントの高速・高精度な解析を実現しました。
DeepSeek がトークン量獲得競争に参入、Anthropic は支出面で依然支配的(12 分読了)
TLDR AI2026年6月10日competitor
DeepSeek がトークン使用量拡大競争に参入した一方、Anthropic は広告費やインフラ投資における支出面での支配的地位を維持し続けており、業界の戦略的分岐が浮き彫りになっている。
VibeThinker-3B:Qwen2.5-Coder-3Bを基盤にスペクトルから信号へのポストトレーニングパイプラインで構築された 30 億パラメータの密着型推論モデル
MarkTechPost2026年6月20日competitor
新浪微博の研究チームが開発した 3B パラメータの軽量推論モデル「VibeThinker-3B」は、独自の訓練パイプラインにより数百倍サイズのモデルと同等の数学・コーディング性能を発揮し、リソース効率化の新たな基準を示した。
中国の AI 巨人 DeepSeek が投資家に対し「自社の人材を他社に引き抜くな」と通告
TLDR AI2026年6月19日subject
中国の AI 大手 DeepSeek が、投資家に対し競合他社への人材引き抜き禁止を要請したと報じられ、AI 業界の人材争奪戦における新たな戦略的動きを示唆している。