ページを読み込み中…
1件の記事
中国のAI企業MiniMaxは、テキスト、画像、動画、音声を一元的なコンテキストとして読み込み、2K解像度で15秒以内の動画とネイティブステレオ音声を生成する汎用マルチモーダル生成モデル「H3」を発表した。