Alibabaが最新TTSモデル「Qwen-Audio-3.0-TTS」を公開、業界最高性能を記録
リアルタイム対話向けのFlash版と高品質なPlus版の2種類を展開する音声合成モデルです。16言語に対応し、感情表現の制御や最大3分間の長文生成が可能です。
日本の事業者にとって、なぜ重要?
TTS性能の向上は、顧客対応AIやコンテンツ制作の効率化に直結します。特にリアルタイム性と表現力の両立は、日本市場におけるAI接客の質を大きく引き上げる可能性があります。
元記事
Introducing the Qwen-Audio-3.0-TTS. Our latest text-to-speech model, in two flavors: • Flash: real-…
元記事を読む選定・発見元
このニュースの選定情報と中国語の掲載内容を確認できます。
AI HOTの掲載ページを見るこのニュースを事業に活かす