読み込み中…
読み込み中…
Topic / モデル
自己蒸留でコード生成性能向上
Apple Machine Learning2026年7月16日subject
Apple Machine Learning は、検証器や教師モデルを不要とする単純な自己蒸留(SSD)手法により、コード生成モデルの性能が劇的に向上することを実証した。
Prime Intellect が Verifiers v1 を発表
TLDR AI2026年7月14日developer
Prime Intellect Lab がベータを脱し、ユーザーが Nvidia や OpenAI のモデルを含む大規模言語モデルの学習・評価・デプロイを自律的に実行できる「自己改善型エージェント」時代のプラットフォームとして正式にリリースされた。
PrismML が Qwen3.6-27B の軽量版「Bonsai 27B」をリリース:ラップトップやスマートフォンで動作する 1 ビットおよび 3 値モデル
MarkTechPost2026年7月15日subject
PrismML は Qwen3.6-27B のアーキテクチャを変更せず、1 ビットおよび 3 値化(Ternary)による高圧縮モデル「Bonsai」を公開し、ラップトップやスマートフォンでの動作を可能にした。
長期ホライズンエージェント向けの能動的メモリ(16 分読)
TLDR AI2026年7月13日developer
本論文は、長期タスクにおいて重要情報が文脈から埋もれる「行動状態の減衰」問題に対処するため、行動エージェントとは別にメモリエージェントを配置して能動的に介入する「Proactive Memory」手法を提案し、ベンチマークで大幅な性能向上を示した。
ミラ・ムラティのシンキングマシーンズラボ、カスタマイズ可能なモデル重みに基づく人間中心 AI の技術的根拠を提示
MarkTechPost2026年7月12日developer
Mira Murati が率いる Thinking Machines Lab は、中央集権的なモデルの限界を指摘し、人間の判断を拡張する分散型・カスタマイズ可能で、価値観が重みに埋め込まれた AI の構築に向けた技術的ロードマップを発表した。
2026 年版オープンソース PDF から JSON への変換モデルガイド
MarkTechPost2026年7月5日competitor
MarkTechPost は、エンタープライズデータ構造化の標準であるオープンソース PDF 抽出モデル「lift」と「NuExtract 3」を比較し、ローカル実行によるコスト削減とプライバシー保護の実現可能性を詳述している。
DeepReinforce が Ornith-1.0 オープンソースコーディングモデルをリリース
TLDR AI2026年6月26日subject
DeepReinforce が、Gemma 4 と Qwen 3.5 を基盤とし、エッジから最前線まで対応する自己改善型コーディングモデル「Ornith-1.0」をオープンソース化して発表した。
DeepReinforce が Ornith-1.0 を公開:自律的に RL スキャフォールドを学習するオープンソースコーディングモデルファミリー
MarkTechPost2026年6月26日subject
DeepReinforce が公開したコーディングエージェント用モデル「Ornith-1.0」は、固定されたハッチスではなく学習によって自律的に最適化されるスキャフォールドを生成する画期的な技術であり、大規模モデルで業界最高水準の性能を示しています。
NVIDIA Nemotron 3 Ultra が長時間実行型エージェントの推論を高速化・効率化
NVIDIA Developer Blog2026年6月4日competitor
NVIDIA は、長期間実行される AI エージェントの推論コストを削減し効率を向上させるため、550B パラメータの MoE モデル「Nemotron 3 Ultra」を発表した。
LLM を明確に解説する面白い論文 5 選
KDnuggets2026年6月3日subject
KDnuggets は、LLM の複雑な仕組みを理解するための基礎となる 5 つの重要な研究論文(Transformer、Few-Shot Learning など)を紹介し、初心者から上級者までが体系的に学習できる道筋を示している。
New in Deep Agents v0.6
LangChain Blog2026年5月14日subject
LangChain Blog が発表した Deep Agents v0.6 は、オープンウェイトモデルの活用コスト削減、長期間実行時のストレージ効率化、およびリアルタイム UI 構築機能の強化により、実運用レベルのエージェント開発を劇的に改善した。
ローカルマックス(3 分読了)
TLDR AI2026年5月12日developer
著者は過去 5 週間にわたるローカル AI モデルの実証実験を通じて、クラウド大規模モデルに依存せずとも日常業務の約半分をローカル環境で完結可能であることを実証し、その主因としてレイテンシの低減が最も重要であると結論付けた。
MachinaCheck:AMD MI300X 上で構築したマルチエージェント CNC 製造可能性システム
Hugging Face Blog2026年5月11日subject
Lablab.ai AMD Developer Hackathon の成果として、AMD MI300X 上で Qwen 2.5 を活用したマルチエージェントシステム「MachinaCheck」が構築され、製造可能性評価の自動化が進んだ。
【AIニュース】2026年4月版 主要ローカルモデル一覧
Latent Space2026年4月14日developer
Latent Spaceは、ベンチマーク結果だけでなく実際のユーザー推薦に基づき、Qwen 3.5やGemma 4などを上位に挙げる2026年4月のローカルLLMモデルリストを公開した。
Aurora:推論効率を向上させるオープンソース強化学習フレームワーク
Together AI Blog2026年3月31日subject
Together AIは、推論トレースからリアルタイムで学習しドラフトモデルを継続的に更新するRLベースのオープンソースフレームワーク「Aurora」を公開し、静的な推論加速の限界を超える自律型最適化を実現した。
オープンモデルコンソーシアム設立の必然性
Interconnects2026年4月11日competitor
著者は、フロントティアのオープンモデル維持コスト増大により企業単独での公開が困難になるため、業界全体で資金を拠出する「オープンモデルコンソーシアム」の設立が必然的かつ必要不可欠であると主張している。
Gemma 4とオープンモデルの成功要因
Interconnects2026年4月4日subject
2026年の飽和したオープンモデル市場において、ベンチマークだけでなくライセンスやツールリング、ファインチューニング容易性など多角的な評価基準を提示し、エージェント時代におけるオープンモデルの真価とビジネス活用への課題を分析している。
Olmo Hybridと将来のLLMアーキテクチャ
Interconnects2026年3月6日developer
AI2研究所は、TransformerとRNN(GDN)を混合した新アーキテクチャ「Olmo Hybrid」7Bモデルを公開し、ハイブリッド型LLMの理論的優位性と実装例を示した。
最新オープンアーティファクト(第19号):Qwen 3.5、GLM 5、MiniMax 2.5 — 中国ラボの最前線への最新のアタック
Interconnects2026年3月4日developer
Qwen、MiniMax、StepFunなどの中国AIラボが最新フラッグシップモデルを相次いで公開し、Open-Weights分野での競争が激化している。
Import AI 454: アライメント研究の自動化、中国モデルの安全性調査、HiFloat4
Import AI2026年4月20日developer
HuaweiのHiFloat4がMXFP4を上回る精度を示す一方、AnthropicはAI安全研究の自動化手法を提示し、中国のハードウェア最適化と西側の安全プロセス革新という二つの重要な潮流が浮き彫りになった。