SpaceXAI、Grok 4.6 が OpenAI 最上位モデルと同等性能で価格を低く設定
本文の状態
日本語全文を表示中
詳細モードで約2分の本文を読めます。
同じ出来事の情報源
この情報源を基点に整理
The Decoder
SpaceXAI が発表した新モデル「Grok 4.6」は、OpenAI の最上位モデルと同等の性能を達成しつつ、価格を大幅に引き下げた。
Continue in AI NEW LAB
このニュースを、実務の判断につなげる
AI NEW LABで、試したことや先に確認したい条件を共有できます。まずはログインなしで読めます。
AI NEW LABで論点を見るAI深層分析を開く2026年8月13日 03:41
AI深層分析
キーポイント
ベンチマークでのトップティア到達
Artificial Analysis Intelligence Index で 61 点を記録し、OpenAI の GPT-5.6 Sol と同点となった。
エージェントタスクにおける卓越した効率性
複雑なタスクを約 53 ステップで完了できる一方、競合の Claude Opus 5 は約 103 ステップを要する。
価格競争力の強化
入力・出力とも従来モデルより 60% 以上安価な設定で、API や主要パートナーを通じて利用可能となった。
重要な引用
Grok 4.6 catches up to frontier models while costing far less.
It completes complex tasks in about 53 steps. Claude Opus 5 needs roughly 103.
編集コメントを表示
編集コメント
SpaceXAI は性能と価格の両面で他社を凌駕するモデルを投入し、業界の標準を再定義した。特にエージェントタスクにおける効率性の向上は、実務利用におけるコスト削減に直結する重要な指標である。
Source Article
元記事を日本語で読む
本文に関係しない購読案内、埋め込み通知、サイト内プロモーションは除いています。
Grok 4.6 が最先端モデルに追いつき、圧倒的な低価格を実現
SpaceXAI の新モデル「Grok 4.6」は、Artificial Analysis Intelligence Index で 61 点を記録し、OpenAI の GPT-5.6 Sol と同点となりました。これは前作の Grok 4.5 から 5 ポイント向上した結果です。現時点でこれより高いスコアを記録しているのは、Anthropic の Claude Opus 5(63 点)と Claude Fable 5(62 点)のみです。

特に注目すべきは、自律的なマルチステップワークフローを実行する「エージェントタスク」での性能です。コンピュータ上での実務知識作業を測定する GDPval-AA v2 ベンチマーク では、Elo スコア 1,753 で Claude Opus 5 に次ぐ第 2 位となりました。複雑なタスクの完了に必要なステップ数は約 53 回で、Claude Opus 5 が約 103 回かかるのと比較すると、その効率の高さが際立ちます。
価格面では、100 万トークンあたり入力 2 ドル・出力 6 ドル($2/$6)と据え置かれました。これは Claude Opus 5($5/$25)や GPT-5.6 Sol($5/$30)と比較して 60% 以上も安価です。Grok 4.6 は、API、Cursor、Grok Build、および OpenRouter、Vercel、Cloudflare などのパートナーを通じて利用可能です。開設初週は、Grok Build と Cursor で使用枠が倍増するキャンペーンも実施されています。
過剰な期待を排した AI ニュース – 人間が厳選
THE DECODER に定期購読すると、広告なしで記事を読めるほか、週刊の AI ニュレターや、年 6 回発行される独占レポート「AI Radar」、アーカイブへのフルアクセス、コメント欄の利用権などが得られます。
原文を表示
Grok 4.6 catches up to frontier models while costing far less. According to the Artificial Analysis Intelligence Index, SpaceXAI's new model scores 61 points, tying OpenAI's GPT-5.6 Sol. Only Anthropic's Claude Opus 5 (63) and Claude Fable 5 (62) score higher. That's a five-point jump over its predecessor, Grok 4.5.

Grok 4.6 performs especially well on agentic tasks, where models independently carry out multi-step workflows. On the GDPval-AA v2 benchmark, which aims to measure real-world knowledge work on a computer, it ranks second with an Elo score of 1,753, trailing only Claude Opus 5. It completes complex tasks in about 53 steps. Claude Opus 5 needs roughly 103.
Pricing stays at $2/$6 per million tokens. That's more than 60 percent cheaper than Claude Opus 5 ($5/$25) and GPT-5.6 Sol ($5/$30). Grok 4.6 is available now through the API, Cursor, Grok Build, and partners like OpenRouter, Vercel, and Cloudflare. For the first week, x.ai is offering double the usage quota in Grok Build and Cursor.
AI News Without the Hype – Curated by Humans
Subscribe to THE DECODER for ad-free reading, a weekly AI newsletter, our exclusive "AI Radar" frontier report six times a year, full archive access, and access to our comment section.
関連記事
今日のまとめ
AIデイリーブリーフで今日の重要ニュースをまとめ読み