ページを読み込み中…
ページを読み込み中…
11件の記事
Hugging Face は NVIDIA の Magpie TTS モデルを用いて低遅延かつ多言語対応可能な音声エージェントを構築する方法と、完全なデプロイ制御を実現するオープンウェイト技術について発表した。
Baseten は、Qwen3-TTS を高品質な音声クローニング用にファインチューニングした手法と結果をエンジニアリングブログで報告した。
通義実験室は、リアルタイム性を重視した「Flash」と高品質な生成を目指す「Plus」の 2 つのバージョンを持つ音声合成モデル「Qwen-Audio-3.0-TTS」を発表し、言語カバー範囲や指令制御の精度を強化した。
The Verge は、近年人気を集める卒業式の AI 音声アナウンスシステムが、学生の名前を誤って発音したり読み飛ばしたりする事例が多発していることを報じた。
開発者がアプリ向けに最適な音声を選択できるよう、600 種類以上の音声ライブラリを素早く検索・選定できる新ツール「Voice Finder」が発表された。