SoranoruNEWS
← 今日の厳選へ戻る
参考 モデル

GoogleがGemini 3.5 Transcribeを発表、高精度なリアルタイム音声認識を実現

要点:Google DeepMindは、85言語以上に対応し、高い精度で文字起こしが可能な音声認識モデル「Gemini 3.5 Transcribe」を公開しました。ストリーミングおよび非ストリーミングの両方に対応し、話者分離やカスタム語彙の登録も可能です。

日本の事業者にとって、なぜ重要?

高精度な文字起こしは、議事録作成やカスタマーサポートの自動化など、業務効率化を推進する日本企業にとって重要な技術基盤となります。

元記事

Google DeepMind:Blog(RSS)

Intelligent transcription with Gemini 3.5 Transcribe

元記事を読む

AI評価

AI評価 68/ 100

外部公開データの選定スコアです。評価元の掲載内容も確認できます。

選定元:AI HOT