AI Gateway に Gemini 3.6 Flash 等追加
Vercel は AI Gateway に Gemini 3.6 Flash と Gemini 3.5 Flash-Lite を追加し、コーディングやアジェンシータスクの効率化とコスト削減を実現した。
キーポイント
新モデルの機能強化
Gemini 3.6 Flash はコーディングやウェブ開発の品質向上とトークン消費量の削減を、Gemini 3.5 Flash-Lite はスコープ限定タスク向けのサブエージェントとしての能力を強化した。
AI Gateway の統合機能
AI Gateway はモデル呼び出しの統一 API、使用状況・コストの追跡、自動リトライおよびフェイルオーバー機能を提供し、プロバイダー依存の高い運用リスクを低減する。
透明な料金体系
AI Gateway はプロバイダー価格をそのまま反映し、推論コストにプラットフォーム手数料やマージンを加算しないため、BYOK(Bring Your Own Key)利用時もコスト透明性が保たれる。
重要な引用
Gemini 3.6 Flash improves quality across coding, agentic tasks, and web development while consuming fewer tokens and making fewer model calls.
AI Gateway provides a unified API for calling models, tracking usage and cost, and configuring retries, failover, and performance optimizations for higher-than-provider uptime.
影響分析・編集コメントを表示
影響分析
このニュースは、大規模言語モデルの導入において、単なるモデル選択だけでなく、運用基盤(Gateway)を通じたコスト最適化と信頼性向上が重要視されていることを示しています。特に、Gemini の新バージョンが「アジェンシータスク」や「コード生成」に特化した性能を示すことで、開発ワークフローの自動化における実用性がさらに高まると予想されます。
編集コメント
Gemini シリーズの最新モデルが、従来の推論コスト削減だけでなく、複雑なタスク分解(アジェンシー)への対応力を強化している点は、実務での活用範囲拡大に寄与します。Vercel の AI Gateway が提供する透明な料金体系と運用機能は、マルチモデル戦略を採用する開発チームにとって即戦力となるインフラと言えます。
AI Gateway に Gemini 3.6 Flash と Gemini 3.5 Flash-Lite が追加されました。
Gemini 3.6 Flash は、コーディングやエージェントタスク、Web 開発の品質を向上させつつ、必要なトークン数とモデル呼び出し回数を削減します。これにより、Web サイトやアプリの開発出力がよりクリーンになります。
Gemini 3.5 Flash Lite では、Flash-Lite タイプのエージェント機能が強化されました。大規模なタスクの一部を担当するサブエージェントなどに向いています。
利用するには、AI SDK でモデルを google/gemini-3.6-flash または google/gemini-3.5-flash-lite に設定してください。
AI Gateway は、モデル呼び出しの一元化 API を提供します。使用状況やコストの追跡、リトライ・フェイルオーバーの設定、パフォーマンス最適化などにより、プロバイダー単体よりも高い稼働率を実現できます。組み込みのカスタムレポート機能、データ保持ゼロ(Zero Data Retention)対応、API キーごとの予算管理、ルーティングルールなどの機能も備えています。
AI Gateway では、プロバイダーの価格をそのまま反映し、マークアップを加えません。推論コストについてもプラットフォーム料金を徴収しません。Bring Your Own Key (BYOK) リクエストにも同様に適用されます。
モデルプレイグラウンドで Gemini 3.6 Flash をお試しください。
さらに詳しく読む
原文を表示
Gemini 3.6 Flash and Gemini 3.5 Flash-Lite are now available on AI Gateway.
Gemini 3.6 Flash improves quality across coding, agentic tasks, and web development while consuming fewer tokens and making fewer model calls. It produces cleaner web and app development output.
Gemini 3.5 Flash Lite upgrades the agentic capabilities of the Flash-Lite tier, making it a good fit for subagents that handle scoped parts of a larger task.
To use them, set model to google/gemini-3.6-flash or google/gemini-3.5-flash-lite in the AI SDK:
AI Gateway provides a unified API for calling models, tracking usage and cost, and configuring retries, failover, and performance optimizations for higher-than-provider uptime. It includes built-in custom reporting, Zero Data Retention support, budgets for API keys, routing rules, and more.
AI Gateway reflects provider pricing with no markup and does not charge a platform fee on inference, including on Bring Your Own Key (BYOK) requests.
Try Gemini 3.6 Flash in the model playground.
Read more
関連記事
今日のまとめ
AI日報で今日の重要ニュースをまとめ読み