ページを読み込み中…
ページを読み込み中…
5件の記事
通義実験室は、リアルタイム性を重視した「Flash」と高品質な生成を目指す「Plus」の 2 つのバージョンを持つ音声合成モデル「Qwen-Audio-3.0-TTS」を発表し、言語カバー範囲や指令制御の精度を強化した。
通義実験室は最新 AI 対話システム「Wan-Streamer v0.2」を発表し、音声認識からアニメーション駆動までのパイプラインを最適化することで応答遅延を約550msに短縮、微表情の読み取りや声・唇・神态の同期を実現したと報告した。
通義実験室は2026年7月15日、既存のFun-Realtime-AudioChatを刷新し、より高速な応答と感情理解機能を備えたリアルタイム音声対話モデル「Qwen-Audio-3.0-Realtime」を発表した。
通義実験室は浙江で、リアルタイム音声認識技術のアップデート版「Fun-ASR-Realtime」を発表し、その性能が向上したことを示した。
通義実験室が、映画・テレビ級の音声合成をサポートする初のマルチモーダル大規模モデル「Fun-CineForge」を発表・オープンソース化した。このモデルは、キャラクターの感情や口の動きに合わせた高品質な音声合成を実現し、AI音声合成技術の新たな進展を示している。