ページを読み込み中…
ページを読み込み中…
12件の記事
Sakana AI はニューヨーク大学と共同で、数十億個の立方体データで学習した生成モデル「Dream-Cubed」を公開し、構造化されたプレイ可能なマインクラフト世界を生成する技術を示した。
YC 支援企業 Interfaze は、260 億パラメータのバックボーンを凍結し、4200 万パラメータのみで訓練した拡散型 ASR モデル「diffusion-gemma-asr-small」をオープンソース化しました。このモデルは自己回帰方式ではなく並列ノイズ除去デコーダーを採用し、1 つのアダプターで 6 か国語の音声認識を可能にします。
ComfyUI が Krea 2 RAW と Krea 2 Turbo のオープンウェイトモデルをローカル環境で利用可能にした。これにより、ユーザーは独自ハードウェアで画像生成や学習が可能になる。
Google は昨年実験的に公開した Gemini Diffusion モデルの研究を再開し、DiffusionGemma として再発表しました。このモデルは以前 1 秒間に 857 トークンの生成速度を記録しており、テキスト生成の高速化に寄与する技術です。