Google presenta Gemini 3.5 Transcribe para convertir voz en texto con IA
Google presentó Gemini 3.5 Transcribe, un modelo para convertir voz en texto con mayor velocidad y una transcripción más “limpia” del discurso. Según la compañía, procesa el trayecto desde la voz del usuario hasta el texto final aproximadamente 70% más rápido que Chirp 3, aunque aclara que la mejora puede variar según el contexto. A diferencia de sistemas que copian palabra por palabra, intenta eliminar muletillas como “eh” o “em”, manejar correcciones durante el dictado y permitir vocabulario personalizado para jerga, nombres propios o expresiones poco comunes. Detecta y transcribe más de 85 idiomas y, en audio pregrabado, puede identificar hablantes e incluir marcas de tiempo a nivel de palabra. Google lo incorporará a Gboard, Gemini para macOS, Antigravity, AI Studio y la API de Gemini, con llegada prevista a Chrome.







