发生了什么

谷歌宣布更新Gemini Audio,引入新一代Gemini 3.5模型,带来更精准的语音转录能力。

新功能能够自动识别专业术语,并支持超过85种语言,同时还能去除“嗯”“啊”之类的填充词。

此次更新推出Gemini 3.5 Live、3.5 Live Experimental和3.5 Transcribe三个模型,旨在提升语音控制AI的精确度,减少背景噪音或语音不清带来的问题。

为什么重要

这表明语音AI在自然语言理解上更进一步,用户无需刻意保持标准发音或避免使用口语化表达。

自动消除语气词能让转录文本更干净,对会议记录、访谈整理等场景尤为实用。

关键事实

谷歌更新了Gemini Audio,加入Gemini 3.5系列模型。

新转录功能支持超过85种语言,并能自动检测专业术语。

新模型包括Gemini 3.5 Live、3.5 Live Experimental和3.5 Transcribe。

接下来看什么

该功能在实际使用中能否准确应对不同口音和嘈杂噪音环境。

谷歌是否会将这些转录能力进一步整合到更多语音控制产品中。

来源