ページを読み込み中…
ページを読み込み中…
8件の記事
Vercel は、xAI が開発した Grok オーディオモデルを自社の AI Gateway に追加しました。これにより、リアルタイム音声やテキスト・音声変換などの機能が、AI SDK 7 を通じて提供されます。
Voxtral が、テキストから音声を生成する新しいモデル「Voxtral TTS」を公開し、開発者が自由に利用・改変できるオープンウェイト形式で提供を開始した。
Googleは、Gemini 3.1 Flash TTSを全Google製品で提供開始した。この新技術は、感情豊かな自然な音声合成を実現し、ユーザー体験を向上させる。
Mistralがスマートウォッチやスマートフォン上で動作可能な新たな音声生成オープンソースモデルをリリースした。
Inworldは、低遅延・高表現力・多言語対応の音声生成モデル「TTS-1.5 Max」をfalプラットフォームに追加した。これにより、開発者はアシスタントやメディア体験など、本番環境でのリアルタイム音声インターフェース構築を強化できる。