ページを読み込み中…
ページを読み込み中…
3件の記事
Nvidia コスモス世界モデルの元リーダー、イーサン・ヘ氏が xAI に移籍し、3 ヶ月で「Grok Image」を構築した経緯について、動画生成やマルチモーダル技術の最前線における実務の核心を語っている。
xAI のエンジニアであるイーサン・ヒー氏は、動画モデルの知能は主に大規模言語モデル(LLM)に由来すると主張し、真の対話型・リアルタイムな世界モデル実現には LLM への注力が次なるフロンティアであると述べています。
xAIは、画像と動画の生成・編集を統合した「Grok Imagine」をAI開発プラットフォーム「fal」で提供開始。複数のモデルエンドポイントを単一スタックに統合し、アイデアから完成品までの制作プロセスを高速化した。