Google、Agentic 向け新 Flash モデル 3 種発表
本文の状態
日本語全文を表示中
詳細モードで約8分の本文を読めます。
同じ出来事の情報源
この情報源を基点に整理
MarkTechPost
Google は生産用エージェント向けに、より安価でトークン効率の高い「Gemini Flash」シリーズの3モデルをリリースし、コスト削減と性能向上を実現した。
AI深層分析を開く2026年7月27日 20:08
AI深層分析
キーポイント
Gemini 3.6 Flash の登場と効率化
Google はコーディングや知識作業に特化した Gemini 3.6 Flash を発表し、出力トークン数を最大 65% 削減する一方、DeepSWE ベンチマークでのスコアを大幅に向上させた。
価格設定の引き下げとコスト削減
Gemini 3.6 Flash の出力トークン単価が 9.00 ドルから 7.50 ドルへ、Gemini 3.5 Flash-Lite は 2.50 ドルに設定され、エージェントタスクの総コスト削減を可能にした。
Flash-Lite の高速処理能力
低遅延と高スループットが求められる検索や文書処理向けに最適化された Gemini 3.5 Flash-Lite は、1 秒間に 350 トークンを出力し、先行モデルを凌駕する性能を示した。
セキュリティ機能の強化
Gemini 3.6 Flash では化学・生物・放射能・核(CBRN)やサイバー攻撃悪用の防止など、 Frontier Safety の新 safeguards が実装された。
Flash-Lite の構成可能な思考レベル
Flash-Lite は最小、低、高の3段階で思考レベルを構成可能であり、開発者は高負荷タスクでは低コスト・低遅延を優先し、多ステップサブエージェントワークロードでは高い思考レベルを選択できる。
重要な引用
On the Artificial Analysis Index, 3.6 Flash uses 17% fewer output tokens than 3.5 Flash.
Gemini 3.6 Flash is priced at $1.50 per 1M input tokens and $7.50 per 1M output tokens.
As measured by Artificial Analysis, it runs at 350 output tokens per second.
Finding deep flaws means exploring an immense execution search space.
編集コメントを表示
編集コメント
今回のリリースは、AI エージェントの実用化における最大の障壁である「コストと速度」のバランスを改善する決定的な一歩となる。特に Flash-Lite の登場により、リアルタイム性が求められる業務への適用範囲がさらに広がるだろう。
Source Article
元記事を日本語で読む
本文に関係しない購読案内、埋め込み通知、サイト内プロモーションは除いています。
プロダクション環境のエージェントを構築する開発者にとって、トークンの効率化、レイテンシの低減、そして信頼性の高いパフォーマンスが求められています。今日、Google は 3 つの新モデル「Gemini 3.6 Flash」「Gemini 3.5 Flash-Lite」「Gemini 3.5 Flash Cyber」をリリースしました。
これら 3 つはすべて「Flash タイア」に属します。この階層は、最大限の推論深度よりも、速度、コスト効率、そして高ボリュームのエージェントワークロードに適応するように Google がチューニングしたものです。
Gemini 3.6 Flash:品質向上、トークン削減、価格低下
Gemini 3.6 Flash は、新しいデフォルトの主力モデルです。3.5 Flash をベースに、コーディング、知識作業、マルチモーダルタスクを対象としています。最大のポイントは効率性の向上です。
Artificial Analysis Index によると、3.6 Flash の出力トークン数は 3.5 Flash よりも 17% 削減されています。また、Datacurve が提供する DeepSWE ベンチマークでは、最大で 65% の削減を実現したと Google は報告しています。さらに、マルチステップワークフローにおける推論ステップ数やツール呼び出し回数も減少しました。
効率化に伴い価格も引き下げられています。Gemini 3.6 Flash の料金は、入力トークン 100 万あたり 1.50 ドル、出力トークン 100 万あたり 7.50 ドルです。出力単価は、従来の 3.5 Flash で 9.00 ドルだったものが下がりました。冗長性の低減と出力価格の引き下げにより、エージェントタスクあたりの総コストが削減されます。
効率性の向上に伴い、品質も大きく改善されました。DeepSWE では 3.6 Flash が 49% を達成し、3.5 Flash の 37% を上回っています。MLE Bench では 63.9% に達し、同ベンチの 3.5 Flash(49.7%)を大きく引き離しました。また OSWorld-Verified では 83.0%、知識労働向けベンチマークである GDPval-AA v2 では 1421 というスコアを獲得し、3.5 Flash の 1349 を上回っています。
コンピュータ操作機能は、Gemini API や Gemini Enterprise を通じて、クライアントサイドの組み込みツールとして利用可能になりました。Hebbia や Harvey といった初期導入企業からは、文書の解析やチャート・データ分析、レポート作成において性能向上が報告されています。
Google は、3.6 Flash に強化された「フロンティアセーフティ」 safeguards を搭載して提供しています。これは化学・生物・放射線・核(CBRN)関連の悪用やサイバー攻撃目的での誤使用を防ぐためのものです。詳細は 3.6 Flash のモデルカードをご覧ください。
以下のインタラクティブな解説ツールでは、各モデルを前世代と比較したり、ご自身の利用量に応じたトークンコストを見積もったりできます。
Gemini 3.5 Flash-Lite:3.5 シリーズで最速のモデル
Gemini 3.5 Flash-Lite は、低遅延かつ高スループットが求められるタスクに最適化されています。主な用途はエージェントによる検索や文書処理です。Artificial Analysis の測定によると、出力トークン生成速度は秒間 350 トークンを記録しています。
料金体系は、入力トークン 100 万あたり 0.30 ドル、出力トークン 100 万あたり 2.50 ドルです。
このモデルは、以前の 3.1 Flash-Lite を大幅に上回っています。Terminal-Bench 2.1 では 54% のスコアを記録し、対照的に 3.1 Flash-Lite は 31% です。長文コンテキストを評価する GDM-MRCR v2 ベンチマークでは 72.2% に達し、同様に 60.1% を記録した従来モデルを凌駕しました。また GDPval-AA v2 では 1140 というスコアを獲得し、対照値の 642 を大きく引き離しています。
特筆すべきは、Flash-Lite がより古い 3 Flash の評価項目でも勝っている点です。SWE-Bench Pro では 54.2% で 49.6% を上回り、OSWorld-Verified でも 74.0% と 65.1% を引き離してリードしています。
Flash-Lite は、思考レベルを「最小」「低」「高」の 3 つから選べるように設計されています。開発者は、大量処理が必要なタスクには低コスト・低遅延の実行を優先できますし、多段階のサブエージェント処理には高い思考レベルを活用することも可能です。また、コンピュータ操作機能も標準で組み込まれています。
Gemini 3.5 Flash Cyber in CodeMender: 安価なエージェントがバグを発見して修正する
Gemini 3.5 Flash Cyber は、最も専門特化したリリースです。これは 3.5 Flash を基盤に、ソフトウェアの脆弱性を発見・検証・修正するために微調整されたモデルです。
この設計の前提は「探索空間の問題」にあります。深い欠陥を見つけるには、膨大な実行探索空間を調査する必要がありますが、巨大な単一モデルへの呼び出しがボトルネックになりかねません。
その解決策は、「安価なモデルを複数回呼び出す」というアプローチです。Google のコードセキュリティエージェントである CodeMender 内では、複数の Gemini 3.5 Flash Cyber エージェントが並列で動作します。CodeMender は最大 5 回モデルを呼び出し、各サブエージェントの発見結果を統合して一つのレポートにまとめます。
この構成は、CyberGym ベンチマークにおいて、はるかに大規模なモデルに対しても競合するパフォーマンスを発揮しています。
内部評価の結果は目を見張るものがあります。Google の「Big Sleep」ベンチマークでは、Flash Cyber がメインラインの 3.5 Flash や 3.6 Flash を大きく上回りました。V8 JavaScript エンジンのテストでは、一定数の実行回数で 55 件の確認済み不具合を発見しました。これに対し、メインラインの 3.5 Flash は 47 件、Claude Opus 4.6 は 36 件でした。Flash Cyber は他モデルが逃した 10 件の問題も捉えています。
実際の運用テストでは、Google のクラウド脆弱性調査チームがこのモデルを活用し、公開 API におけるリモートコード実行の欠陥をわずか 2 時間で特定しました。
imagehttps://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-6-flash-3-5-flash-lite-3-5-flash-cyber/
コミュニティの反応は、予想通り二極化しました。開発者たちは価格と効率性を歓迎しましたが、旗艦モデルの遅れについては最も厳しい批判が浴せられました。
Hacker News では、「Google は信頼できる供給能力を超えて過剰に宣伝している」という意見も出され、実際にコードを書くセッションで苛立たしい思いをしたという声もありました。また、Flash Cyber のアクセス制限は、自動的な脆弱性発見ツールの管理を誰が行うべきかという「デュアルユース(二重利用)」の議論を巻き起こしました。
以下のダッシュボードは、プラットフォームごとの議論を集約したものです。これはスクレイピングされたデータセットではなく、質的編集による合成であり、その手法に関する注釈も併記されています。
利用開始について
Gemini 3.6 Flash と Gemini 3.5 Flash-Lite は、本日より利用可能です。開発者は Google AI Studio や Android Studio を通じて Gemini API でこれらのモデルにアクセスできます。また、Gemini 3.6 Flash は「Google Antigravity」にも導入され、GitHub Copilot でも順次展開されています。企業向けには Gemini Enterprise Agent Platform で両モデルを提供しており、Gemini 3.6 Flash は Gemini Enterprise アプリでも利用可能です。一般ユーザーは Gemini アプリを通じて利用でき、Gemini 3.5 Flash-Lite は Google Search での展開も進んでいます。
まずは開発者ガイドをご覧ください。
主なポイント
Gemini 3.6 Flash は出力トークン数を最大で 17% 削減(DeepSWE では最大 65%)し、出力料金を 100 万トークンあたり 9 ドルから 7.5 ドルに引き下げました。
Gemini 3.5 Flash-Lite は秒間 350 トークンの処理速度で、100 万トークンあたり 0.30 ドル(出力)と 2.50 ドル(入力)という価格設定です。SWE-Bench Pro や OSWorld-Verified のベンチマークでは、従来の「Gemini 3 Flash」を上回る性能を発揮しました。
Gemini 3.5 Flash Cyber は、低コストでマルチエージェントによるスキャンを可能にし、「CodeMender」の基盤となっています。その結果、V8 ベースの脆弱性として 55 の固有な問題を検出しました。これは Gemini 3.5 Flash が 47 件、Opus 4.6 が 36 件だったのと比較して優れています。
Flash Cyber は二重利用リスク(軍事転用などの懸念)があるため、政府機関や信頼できるパートナー限定の制限付きパイロットプログラムとして提供されています。
Google が Gemini 3.6 Flash、3.5 Flash-Lite、そして 3.5 Flash Cyber を発表しました。これらはエージェントワークロード向けに設計された、より安価でトークン効率の高い「Flash」シリーズの最新モデルです。
この発表は、MarkTechPost で最初に報じられました。
AI算出
主要ニュースainew評価標準
AI モデルの具体的なバージョンアップと性能・価格の詳細な比較データが含まれており、新規性の高い主要ニュースである。ただし、日本企業への直接的な影響や日本語での独自情報はないため、日本の関連性は低めに見積もる。
6つの評価軸を見る
- AI関連度
- 100
- 情報源の信頼性
- 25
- 新規性
- 75
- 調べる価値
- 100
- 重複の少なさ
- 100
- 日本での有用性
- 25
関連記事
News to Guide
ニュースの次に確認する
発表内容を、現在の料金や仕様と照らし合わせられる関連ガイドです。
今日のまとめ
AIデイリーブリーフで今日の重要ニュースをまとめ読み