Qué ocurrió
Google ha actualizado su servicio Gemini Audio con nuevos modelos Gemini 3.5, entre ellos Gemini 3.5 Live, 3.5 Live Experimental y 3.5 Transcribe.
Según el anuncio, las nuevas funciones de transcripción detectan automáticamente la jerga especializada y admiten más de 85 idiomas.
Google afirma que los modelos están diseñados para ofrecer mayor precisión en las funciones de IA controladas por voz, incluso cuando hay ruido de fondo o el habla no es clara.
Por qué es importante
Eliminar automáticamente las muletillas como los 'eh' y los 'este' puede hacer que las transcripciones generadas por IA sean más limpias y legibles para reuniones, notas o subtítulos.
El soporte para jerga especializada y una amplia gama de idiomas podría hacer que Gemini Audio sea más práctico en campos como la medicina, el derecho y los negocios internacionales.
Datos clave
La actualización forma parte del conjunto de funciones de Gemini Audio de Google.
Introduce tres nuevos modelos: Gemini 3.5 Live, 3.5 Live Experimental y 3.5 Transcribe.
La transcripción detecta jerga especializada y admite más de 85 idiomas.
Los modelos están diseñados para manejar el ruido de fondo y el habla imperfecta sin dificultades.
Qué observar a continuación
Si la eliminación de palabras de relleno seguirá siendo opcional para los usuarios que necesiten transcripciones textuales.
Qué tan bien funcionan la detección de jerga y el soporte multilingüe en entornos reales y ruidosos.
