Today, we’re launching Gemini 3.5 Transcribe, our new speech-to-text model with sub-second streaming...
Philipp Schmid(@_philschmid)243 字 (约 1 分钟)
85
Google推出Gemini 3.5 Transcribe语音识别模型,实现亚秒级实时流处理,非流式WER低至2.6%,支持85种语言并减少70%处理时间。
入选理由:Gemini 3.5 Transcribe非流式WER达2.6%,流式为4.0%
FeaturedTweet#语音识别#Gemini#AI模型#实时处理中英混合