Google DeepMind·· 2026-08-27精选AI 评分78
Google 发布 Gemini 3.5 Transcribe 语音转写模型
Intelligent transcription with Gemini 3.5 Transcribe
AI 导读
Google 发布 Gemini 3.5 Transcribe 语音转写模型,支持实时双向流式转写和预录音处理,面向语音智能体、实时字幕与通话分析等场景。模型可自动处理自我修正、填充词和格式化文本,支持超过 85 种语言,并提供最多三位说话人的识别与时间戳。
推荐理由
Gemini 3.5 Transcribe同时覆盖实时流式与预录音处理,并给出WER、延迟和语言支持等指标,便于开发者评估接入场景。
来源:Google DeepMind · deepmind.google