ページを読み込み中…
ページを読み込み中…
2件の記事
Zyphra は、画像とテキストを同時に処理するオープンソースのビジョン言語モデル「Zamba2-VL」シリーズ(パラメータ数 1.2B/2.7B/7B)を公開した。同社は従来の密集型 Transformer に代わり、ハイブリッド状態空間設計を採用し、競合と同等の精度を維持しつつ初トークン生成時間を約 10 倍短縮する技術を実現した。
Adobe Researchは、行動に基づいて未来フレームを予測するビデオワールドモデルにおいて、状態空間モデルを活用して長期記憶の課題を解決した。これにより、エージェントが動的環境で過去の状態を保持し、計画や推論を行う能力が向上する。