Today, we’re launching Gemini 3.5 Transcribe, our new speech-to-text model with sub-second streaming...
Google推出Gemini 3.5 Transcribe语音识别模型,实现亚秒级实时流处理,非流式WER低至2.6%,支持85种语言并减少70%处理时间。
入选理由:Gemini 3.5 Transcribe非流式WER达2.6%,流式为4.0%
产品
别名:Gemini 3.5 STT
Google新推出的语音转文本模型
已跟踪 8 条高相关材料
最近变化
2026-08-26 · Gemini 3.5 Transcribe模型已集成至Google多款产品中
为什么值得关注
Gemini 3.5 Transcribe 被反复提及时,通常意味着它正在影响产品路线、开发者工作流或 AI 产业判断。这个页面把分散材料合并成一个可持续更新的观察入口。
Introducing Gemini 3.5 Transcribe, our new speech to text model with smart transcription, function c...
Logan Kilpatrick(@OfficialLoganK) · 8.5 分
Gemini 3.5 Transcribe 是 Google 推出的新一代语音转文字模型,支持 85 种语言、实时流媒体和多说话人识别。
blog post: https://t.co/EnPNbZpsVk
Patrick Loeber(@patloeber) · 8.5 分
Google推出Gemini 3.5 Transcribe和Gemini 3.5 Transcribe Live模型,分别用于录音音频转录和实时语音应用开发。
Today, we’re launching Gemini 3.5 Transcribe, our new speech-to-text model with sub-second streaming...
Philipp Schmid(@_philschmid) · 8.5 分
Google推出Gemini 3.5 Transcribe语音识别模型,实现亚秒级实时流处理,非流式WER低至2.6%,支持85种语言并减少70%处理时间。
已收录 8 条与 Gemini 3.5 Transcribe 相关的内容,按评分排序。
Google推出Gemini 3.5 Transcribe语音识别模型,实现亚秒级实时流处理,非流式WER低至2.6%,支持85种语言并减少70%处理时间。
入选理由:Gemini 3.5 Transcribe非流式WER达2.6%,流式为4.0%
Google推出Gemini 3.5 Transcribe和Gemini 3.5 Transcribe Live模型,分别用于录音音频转录和实时语音应用开发。
入选理由:Gemini 3.5 Transcribe支持录音音频转录,提供说话人归属和词级时间戳。
Gemini 3.5 Transcribe 是 Google 推出的新一代语音转文字模型,支持 85 种语言、实时流媒体和多说话人识别。
入选理由:支持 85 种语言及多说话人识别,适用全球化场景
Gemini 3.5 Transcribe 支持 85+ 语言自动识别和自定义词汇,适用于多场景语音应用开发。
入选理由:自动检测 85 种语言,无需人工设置语言参数
Google 推出 Gemini 3.5 Transcribe 模型,能精准识别代码上下文并过滤口头犹豫。
入选理由:Gemini 3.5 Transcribe 可过滤口头犹豫,提升语音转文字准确性
Google DeepMind 宣布发布 Gemini 3.5 Transcribe 语音转文本模型,但推文内容缺乏技术细节和深度分析。
入选理由:Gemini 3.5 Transcribe 是 Google DeepMind 最新语音转文本模型
Google推出Gemini 3.5 Transcribe模型,已应用于多款产品,提升音频转录能力。
入选理由:Gemini 3.5 Transcribe模型已集成至Google多款产品中
Google 推出 Gemini 3.5 Transcribe 模型,宣称能精准识别代码上下文中的技术术语。
入选理由:Gemini 3.5 Transcribe 可过滤口语中的犹豫用语