GoogleがGemini 3.5 Transcribeを発表、高精度なリアルタイム音声認識を実現
要点:Google DeepMindは、85言語以上に対応し、高い精度で文字起こしが可能な音声認識モデル「Gemini 3.5 Transcribe」を公開しました。ストリーミングおよび非ストリーミングの両方に対応し、話者分離やカスタム語彙の登録も可能です。
日本の事業者にとって、なぜ重要?
高精度な文字起こしは、議事録作成やカスタマーサポートの自動化など、業務効率化を推進する日本企業にとって重要な技術基盤となります。
元記事
Intelligent transcription with Gemini 3.5 Transcribe
元記事を読むAI評価
外部公開データの選定スコアです。評価元の掲載内容も確認できます。
選定元:AI HOT