谷歌今天宣布推出 Gemini 3.5 Transcribe,这是一款语音转文本 AI 模型,速度约比其前代产品 Chirp 3 快 70%。该模型的实时语音错误率为 5.5%,而 Chirp 3 为 7.32%。Gemini 3.5 Transcribe 会从语音输入中去除“嗯”和“呃”等口头填充词,并能实时编辑更正内容。它支持 85 种语言,还能处理最多包含三位说话者的预录音频。