AI Gateway に MiniMax H3 が追加、2K 動画生成をサポート
本文の状態
日本語全文を表示中
詳細モードで約1分の本文を読めます。
同じ出来事の情報源
この情報源を基点に整理
Vercel Blog
Vercel が提供する AI Gateway に、テキストや画像、動画、音声から 2K 解像度の動画を生成する MiniMax H3 モデルが追加された。
AI深層分析を開く2026年8月2日 00:28
AI深層分析
キーポイント
多様な入力形式への対応
MiniMax H3 はテキストプロンプト、開始画像、最初のフレームと最後のフレームの組み合わせ、あるいは参照素材などから動画を生成できる。
高度な制御機能の実装
同モデルは最初のフレームから最後のフレームへのキーフレーム遷移や、画像・動画・音声を単一リクエストで条件とするマルチモーダル参照機能をサポートする。
出力形式と解像度の標準化
生成される動画は MP4 形式で 2K 解像度、5〜15 秒の長さであり、アスペクト比は 21:9 から 16:9、4:3 など多様な比率に対応する。
AI SDK を介した実装
開発者は AI SDK でモデルを「minimax/minimax-h3」に設定することで、開始画像のアニメーションや参照素材の指定といった機能を利用できる。
重要な引用
H3 generates 2K video from a text prompt, a starting image, a pair of first and last frames, or reference material.
Reference and keyframe modes are mutually exclusive.
編集コメントを表示
編集コメント
動画生成モデルが単なるテキスト入力から、フレーム指定やマルチモーダル参照へと進化していることは、実用的なコンテンツ制作における制御性を高める重要なステップである。Vercel の AI Gateway に統合されたことで、開発者が即座にこの高度な機能をプロトタイプに組み込める環境が整ったと言える。
Source Article
元記事を日本語で読む
本文に関係しない購読案内、埋め込み通知、サイト内プロモーションは除いています。
AI Gateway にて、MiniMax H3 の利用が可能になりました。
H3 はテキストプロンプト、開始画像、最初のフレームと最後のフレームのペア、あるいは参照素材から 2K ビデオを生成します。
テキストから動画への変換や、最初のフレーム画像からの動画生成に加え、最初のフレームから最後のフレームへのキーフレーム間遷移、そしてマルチモーダルな参照素材からの動画生成にも対応しています。単一のリクエストで、画像、動画、音声のいずれかを参照元として指定し、生成を制御することが可能です。ただし、参照モードとキーフレームモードは同時に使用することはできません。
出力形式は MP4 で、解像度は 2K、長さは 5〜15 秒です。アスペクト比は 21:9、16:9、4:3、1:1、3:4、9:16 を選択でき、指定された画像に合わせて自動的に調整することも可能です。
MiniMax H3 を利用するには、AI SDK でモデルを minimax/minimax-h3 に設定してください。
プロンプトに開始画像を渡すと、その画像のアスペクト比に従ってアニメーションが生成されます。
参照画像、動画、または音声をソース素材として提供し、プロンプト内の順序で各素材を参照することで、動画出力への参照を実現できます。
AI Gateway 上のすべての動画モデル一覧はこちら。MiniMax H3 はモデルプレイグラウンドでもお試しください。
原文を表示
MiniMax H3 is now available on AI Gateway.
H3 generates 2K video from a text prompt, a starting image, a pair of first and last frames, or reference material.
Alongside text-to-video and first-frame image-to-video, the model supports first-to-last keyframe transitions and multimodal reference-to-video, conditioning a generation on reference images, video, or audio in a single request. Reference and keyframe modes are mutually exclusive. Output is mp4 at 2K resolution, from 5 to 15 seconds, in aspect ratios including 21:9, 16:9, 4:3, 1:1, 3:4, and 9:16, or adaptive to a supplied image.
To use MiniMax H3, set model to minimax/minimax-h3 in the AI SDK:
Pass a starting image with the prompt, and the model animates it following the image's aspect ratio.
Supply reference images, video, or audio as source material, and refer to each by its order in the prompt for reference to video output.
View all video models on AI Gateway. Try MiniMax H3 in the model playground.
Read more
関連記事
今日のまとめ
AIデイリーブリーフで今日の重要ニュースをまとめ読み