Google、Gemini 3.8 Flash を発表し知能指数 59 に到達
本文の状態
日本語全文を表示中
詳細モードで約4分の本文を読めます。
同じ出来事の情報源
この情報源を基点に整理
Artificial Analysis
Google DeepMind は推論能力を強化した新モデル「Gemini 3.8 Flash」を発表し、人工知能指数で 59 を達成してコスト効率の最適化フロンティアに到達した。
AI深層分析を開く2026年9月3日 01:38
AI深層分析
キーポイント
性能とコスト効率の最適化
Gemini 3.8 Flash は推論レベル「high」で人工知能指数 59 を記録し、タスクあたりのコスト$0.58で業界最安水準を達成した。
エージェント機能の大幅強化
ツール使用やコーディングなどの評価において前モデルから大きく改善され、特に𝜏³-Banking で 12 ポイントの上昇を示した。
出力トークン数の増加と価格設定
タスクあたりの平均出力トークン数が 30% 増の 48k に達したが、年内は前モデルと同様の割引価格で提供される。
知能とコストのトレードオフにおける最適化
Gemini 3.8 Flash (high) は知能指数タスクあたり0.58ドルで、同等レベルのモデル中最安となる。ただし、1タスクあたりの出力トークン数やエージェント評価でのターン増加により、前作比でコストは約40%上昇している。
推論強度に応じた処理時間と速度の変化
高推論設定では1秒あたり約300トークンの出力速度を維持するが、タスク完了時間は2.5分となり前作から延長された。一方、低推論設定では0.8分まで短縮され、知能対処理時間のパレートフロンティアに位置する。
重要な引用
Gemini 3.8 Flash scores 59 on the Artificial Analysis Intelligence Index and reaches the Intelligence vs. Cost per Task Pareto frontier
The largest improvement is on 𝜏³-Banking, where it gains 12 points over Gemini 3.7 Flash to score 45%
Gemini 3.8 Flash (high) costs $0.58 per Intelligence Index task, making it the cheapest model at its level of intelligence
Gemini 3.8 Flash (high) costs $0.58 per Intelligence Index task, making it the cheapest model at its level of intelligence.
編集コメントを表示
編集コメント
Gemini 3.8 Flash は、推論能力の向上とコスト効率のバランスを追求したモデルとして位置づけられる。特にエージェント機能の強化は、実務での活用範囲を広げる重要な要素と言える。
Source Article
元記事を日本語で読む
本文に関係しない購読案内、埋め込み通知、サイト内プロモーションは除いています。
モデルページはこちら:https://artificialanalysis.ai/models/gemini-3-8-flash
Gemini 3.8 Flash は Artificial Analysis のインテリジェンス指数で 59 を記録し、タスクあたりのコストと性能の最適解であるパレートフロンティアに到達しました。
Google DeepMind が本日、Gemini 3.8 Flash を発表しました。高い推論能力を備えたこのモデルは、Artificial Analysis のインテリジェンス指数で 59 を獲得し、前作の Gemini 3.7 Flash より 3 ポイント向上しています。これは GPT-5.6 Sol(xhigh、59)や Grok 4.6(medium、59)といった、最大限ではない推論設定での競合モデルと同等のスコアです。
今年末まで Gemini 3.7 Flash と同じ割引価格(入力・出力トークンあたり 100 万枚でそれぞれ 0.75 ドル/3.75 ドル)が適用される Gemini 3.8 Flash ですが、タスクあたりのコストは 0.58 ドルとなり、性能とコストのバランスを示すパレートフロンティアに位置しています。これは GPT-5.6 Terra(max、0.53 ドル)と比較可能な水準ですが、前作よりも約 40% 高くなっています。これは、1 タスクあたりの平均出力トークン数が 48k に増加し、エージェント評価におけるターン数が増えたことが主な要因です。

Gemini 3.8 Flash の 3 つの推論レベルにおける主要なベンチマーク結果:
➤ インテリジェンス指数で 3 ポイント向上: Gemini 3.8 Flash (high) は、Artificial Analysis Intelligence Index で 59 を記録し、Gemini 3.7 Flash (high, 56) より 3 ポイント改善しました。中程度の推論モードでは 57 点となり、GPT-5.6 Terra (max, 57) や Muse Spark 1.2 (xhigh, 57) と同点です。低推論モードでは 52 点を記録し、Gemini 3.6 Flash (high, 52) と同等の性能を維持しながら、タスクあたりのコストは 30% 削減、所要時間も約 1/3 に短縮されています。
➤ エージェント機能の強化: Gemini 3.8 Flash の Artificial Analysis Intelligence Index での 3 ポイント向上は、主に 𝜏³-Banking (ツール使用)、Terminal-Bench v2.1 (コーディング)、GDPval-AA v2 (実世界タスク) といったエージェント評価における性能向上によるものです。最も大きな改善が見られたのは 𝜏³-Banking で、Gemini 3.7 Flash を上回る 12 ポイントの伸びとなり、スコアは 45% に達しました。
➤ インテリジェンスとタスクあたりのコストにおけるパレート最適: Gemini 3.8 Flash (high) のインテリジェンス指数 1 単位あたりのコストは 0.58 ドルで、同レベルのモデルの中で最も安価です。これは、トークン単価の変更がないにもかかわらず、タスクあたりの出力トークン数が 30% 増加し、エージェント評価でのターン数が増えたことで実現されました。Gemini 3.7 Flash の 0.40 ドルから約 40% 上昇していますが、中程度の推論モードでは 0.41 ドルに、低推論モードでは 0.24 ドルまでコストを下げることが可能です。

出力速度は依然として高速ですが、タスクあたりの所要時間は増加しています。高推論モードでは、Gemini 3.8 Flash の平均出力速度は秒間約 300 トークンで、タスクあたりの所要時間は 2.5 分です。これは GPT-5.6 Luna(最大値:2.6 分)や GPT-5.6 Terra(最大値:3.3 分)よりわずかに速い一方、Gemini 3.7 Flash と比較すると、トークン使用量の増加により所要時間が 2.2 分から 2.5 分に延び、Claude Fable 5.1(ミディアム:2.1 分)を下回っています。一方、低推論モードではタスクあたりの所要時間は 0.8 分に短縮され、Gemini 3.8 Flash は「知能と所要時間」のパレート最適フロンティアに位置します。

主要なモデルの詳細:
➤ コンテキストウィンドウ: 1M トークン。Gemini 3.7 Flash と同じです。
➤ マルチモーダル対応: テキスト、画像、動画、音声の入力に対応し、出力はテキストのみです。
➤ 料金体系: 今年末まで、入力・出力トークン 1M あたりそれぞれ $0.75/$3.75 で、Gemini 3.7 Flash の現在の割引価格と同等です。標準価格は 1M トークンあたり $1.50/$7.50 です。キャッシュされた入力トークンは引き続き 90% の割引が適用されます。

関連記事
News to Guide
ニュースの次に確認する
発表内容を、現在の料金や仕様と照らし合わせられる関連ガイドです。
今日のまとめ
AIデイリーブリーフで今日の重要ニュースをまとめ読み