ページを読み込み中…
ページを読み込み中…
2件の記事
アリババ傘下のTongyi Labは、16か国語に対応しリアルタイム性と高品質性を備えたホスト型テキスト音声合成モデル「Qwen-Audio-3.0-TTS」をAlibaba Cloud Model Studioで公開した。
Stability AIとArmは、Arm CPU上で動作する3億4100万パラメータのテキスト音声変換モデル「Stable Audio Open Small」をオープンソース化した。スマートフォンで最大11秒の音声を8秒未満で生成できる。