通義実験室がリアルタイム音声合成モデル「Qwen-Audio-3.0-TTS」を発表
通義実験室は、低遅延の「Flash」版と高性能な「Plus」版からなる音声合成モデルを公開しました。16言語と20種類の方言に対応し、高い話者類似度とリアルタイム性を実現しています。
日本の事業者にとって、なぜ重要?
多言語対応の音声合成技術は、グローバルな顧客対応やコンテンツ制作の自動化において、日本企業にとっても活用が期待される技術です。
元記事
从"能说话"到"会表达":Qwen-Audio-3.0-TTS 发布
元記事を読む選定・発見元
このニュースの選定情報と中国語の掲載内容を確認できます。
AI HOTの掲載ページを見るこのニュースを事業に活かす