ページを読み込み中…
ページを読み込み中…
6件の記事
Google DeepMind が発表した画像生成モデル「Gemini 3.1 Flash Lite Image」は、速度と規模に最適化された最も高速かつ低コストな Gemini 画像モデルである。
Twitterユーザーのスコット・ラウは、ペリカンが自転車に乗るベンチマークに対し、テストを積み重ねる必要があると指摘した。
OpenAIは長年推測されてきた画像生成モデル「GPT-Image-2」をAPIおよびChatGPTで正式公開した。思考機能付き・なしの両バリアントを提供し、競合モデルを凌駕する性能を示している。
PRXチームが、わずか24時間でテキストから画像を生成するAIモデルをトレーニングする手法を発表した。この高速トレーニング手法は、AI開発の効率化とリソース削減に貢献する可能性がある。
研究者がテキストから画像生成モデルの学習設計を検証し、アブレーション研究を通じて効果的な学習手法を特定した。
Microsoftが、Stable Diffusion 3.5 LargeをAzure AI Foundryのモデルカタログで公開した。これにより、あらゆる規模の企業がMicrosoftの信頼できるエコシステム内でプロフェッショナルグレードの画像生成技術にアクセスできるようになる。