发生了什么
谷歌宣布更新Gemini Audio,引入新一代Gemini 3.5模型,带来更精准的语音转录能力。
新功能能够自动识别专业术语,并支持超过85种语言,同时还能去除“嗯”“啊”之类的填充词。
此次更新推出Gemini 3.5 Live、3.5 Live Experimental和3.5 Transcribe三个模型,旨在提升语音控制AI的精确度,减少背景噪音或语音不清带来的问题。
为什么重要
这表明语音AI在自然语言理解上更进一步,用户无需刻意保持标准发音或避免使用口语化表达。
自动消除语气词能让转录文本更干净,对会议记录、访谈整理等场景尤为实用。
关键事实
谷歌更新了Gemini Audio,加入Gemini 3.5系列模型。
新转录功能支持超过85种语言,并能自动检测专业术语。
新模型包括Gemini 3.5 Live、3.5 Live Experimental和3.5 Transcribe。
接下来看什么
该功能在实际使用中能否准确应对不同口音和嘈杂噪音环境。
谷歌是否会将这些转录能力进一步整合到更多语音控制产品中。
