読み込み中…
2件の記事
アリババ傘下のTongyi Labは、16か国語に対応しリアルタイム性と高品質性を備えたホスト型テキスト音声合成モデル「Qwen-Audio-3.0-TTS」をAlibaba Cloud Model Studioで公開した。
通義实验室は音声認識大模型「Fun-ASR1.5」をリリースした。同モデルは30言語と7大方言を単一アーキテクチャで処理し、典型方言の誤り率を56%削減して工業級の実用化を実現した。