通義実験室がリアルタイム音声合成モデル「Qwen-Audio-3.0-TTS」を発表
要点:通義実験室は、低遅延の「Flash」版と高性能な「Plus」版からなる音声合成モデルを公開しました。16言語と20種類の方言に対応し、高い話者類似度とリアルタイム性を実現しています。
日本の事業者にとって、なぜ重要?
多言語対応の音声合成技術は、グローバルな顧客対応やコンテンツ制作の自動化において、日本企業にとっても活用が期待される技術です。
元記事
从"能说话"到"会表达":Qwen-Audio-3.0-TTS 发布
元記事を読むAI評価
外部公開データの選定スコアです。評価元の掲載内容も確認できます。
選定元:AI HOT