ページを読み込み中…
Topic / モデル
全28件中 1–20件 · 13媒体
Perplexity、Apple Silicon向け推論エンジン「Lily」をオープンソース化
MarkTechPost2026年9月3日主題
Perplexity は Rust と Metal を用いたローカル推論エンジン「Lily」を公開し、PyTorch や MLX を介さず Qwen3.6-35B-A3B の高速実行を実現した。
Qwen、マルチモーダル MoE モデル「Qwen3.8-Flash-Next」を公開
Simon Willison Blog2026年8月27日開発元
Qwen はマルチモーダル MoE モデル「Qwen3.8-Flash-Next」を公開し、125B トークンで 6B のアクティブパラメータを持つこのモデルは Qwen4 のアーキテクチャの初期プレビューとして機能する。
Qwen3.8-Flash-Next、新アーキテクチャでコスト効率追求
Qwen Blog2026年8月26日開発元
Qwen は次世代アーキテクチャの早期検証用モデルとして Qwen3.8-Flash-Next を公開し、GDN と QSA のハイブリッド設計など 4 つの側面での大幅な効率化と性能向上を発表した。
llama.cpp、DFlash、Pi でローカル環境の Muse Glimmer を実行しコーディング体験を向上
KDnuggets2026年8月21日競合
Muse Glimmer は Qwen の 27B クラスモデルと比較され、特にローカルでのコーディングやエージェントワークフローにおいて多くの場合で優れたパフォーマンスを発揮しているとされている。
Qwen3.8-27B を Ollama と OpenCode でローカル AI コーディングエージェントとして実行
KDnuggets2026年8月18日開発元
Qwen3.8-27B、Ollama、OpenCode を組み合わせることで、複雑な環境構築なしにローカル AI コーディングエージェントを数コマンドで起動する方法が示される。
Qwen 3.8 27B が Artificial Analysis インデックスで 52 点
Simon Willison Blog2026年8月18日開発元
Simon Willison は Qwen 3.8 27B がインテリジェンスインデックスで 52 点を獲得し、GPT-5.6 Luna や GLM-5.2 と同等の性能を持つと評価した。
XYZ-Aquila-SFT と Qwen3 を用いたツール呼び出し LLM の微調整完全ガイド
MarkTechPost2026年8月15日主題
MarkTechPost は、XYZ-Aquila-SFT データセットと Qwen3-0.6B モデルを用いたツール呼び出し機能の教師あり微調整パイプラインの実装手順を詳述している。
Modal、Qwen3.8-2.4T-A95B の提供を開始し高速化を強化
Modal Blog2026年8月12日開発元
Modal は Qwen3.8-2.4T-A95B のオープンウェイトモデルを公開し、SGLang と DFlash 仕様に最適化したスペキュレーターを搭載した Auto Endpoints で即日サポートを開始した。
SGLang と Miles が Qwen3.8 の Day-0 サポートを開始
LMSYS Blog2026年8月12日主題
SGLang と Miles が Qwen3.8-2.4T-A95B の Day-0 サポートを開始し、NVFP4 量子化やハイブリッドアテンション対応など大規模モデルの高速推論を実現した。
Hugging Face、多言語数学推論に On-Policy Delta Distillation を提案
Hugging Face Daily Papers2026年8月6日主題
ポストトレーニング後の教師モデルとベースモデル間の確率差を学習信号として用いる OPD^2 が、従来の On-Policy Distillation (OPD) を一貫して上回る性能を発揮することが確認された。
2026 年開発者に重要なオープンウェイト AI モデル 5 選
Cline Blog2026年8月4日開発元
Cline Blog は2026年における開発者にとって重要なオープンウェイトモデル5選を特定し、各モデルのコーディング性能やコスト構造を比較分析して提示した。
Qwen、コーディングと協働で新基準「Qwen3.8-Max」を公開へ
Qwen Blog2026年8月3日開発元
Qwen は Qwen 3.8-Max をリリースし、2.4兆パラメータのモデルとしてコーディングや複雑なタスク処理能力を大幅に向上させ、来週には重みもオープンソース化すると発表した。
Kimi K3 と Qwen 3.8 の Attention 機構比較分析
zartbot2026年7月27日主題
10T 規模モデルの訓練には国内算力のみで約 20 万枚の GPU と数百億円の建設費が必要となり、このコスト構造が Linear や Sparse への移行を迫る主要因となっている。
Open models 動向:Kimi K3・Qwen 3.8・WAIC 演説を解説
Interconnects2026年7月22日開発元
Interconnects の podcast は、Kimi K3 や Qwen の最新動向を踏まえ、中国モデルの台頭、オープンソースとクローズドの経済格差、そして中国政府によるオープンソース戦略へのコミットメントについて詳述している。
DeepReinforce が Ornith-1.0 を公開:自律的に RL スキャフォールドを学習するオープンソースコーディングモデルファミリー
MarkTechPost2026年6月26日主題
DeepReinforce が公開したコーディングエージェント用モデル「Ornith-1.0」は、固定されたハッチスではなく学習によって自律的に最適化されるスキャフォールドを生成する画期的な技術であり、大規模モデルで業界最高水準の性能を示しています。
Qwen3.6-27B:270億パラメータの密型モデルでフラッグシップ級コーディング性能
Simon Willison Blog2026年4月23日開発元
Qwenが公開した27BパラメータのDenseモデル「Qwen3.6-27B」は、ローカル環境での量子化推論によりフラッグシップ級のコーディング性能を実現し、大規模MoEモデルを上回るベンチマーク結果を示した。
【AIニュース】2026年4月版 主要ローカルモデル一覧
Latent Space2026年4月14日開発元
Latent Spaceは、ベンチマーク結果だけでなく実際のユーザー推薦に基づき、Qwen 3.5やGemma 4などを上位に挙げる2026年4月のローカルLLMモデルリストを公開した。
Gemma 4とオープンモデルの成功要因
Interconnects2026年4月4日主題
2026年の飽和したオープンモデル市場において、ベンチマークだけでなくライセンスやツールリング、ファインチューニング容易性など多角的な評価基準を提示し、エージェント時代におけるオープンモデルの真価とビジネス活用への課題を分析している。
データセンターへの攻撃、全サイズのQwen3.5、DeepSeekの華為戦略、Appleのマルチモーダルトークナイザー
The Batch2026年3月20日開発元
AI業界のニュースレター「The Batch」は、データセンターへの攻撃、Qwen3.5の全サイズ展開、DeepSeekのHuawei戦略、Appleのマルチモーダルトークナイザーといった技術動向を報じつつ、業界関係者の間で広がる職務不安感について言及している。
Qwen3.5 × Twinkle 低コストモデルトレーニングのベストプラクティス
通义大模型2026年3月12日主題
通義大模型は、分散学習の複雑さを解消するオープンソースフレームワーク「Twinkle」を公開し、Qwen3.5を用いた低コスト・高効率なLoRAファインチューニングの実践コードを提示した。