Por qué importa
Google integra dictado, edición y comprensión contextual en un solo atajo de teclado, algo que antes requería cambiar entre aplicaciones. La función reduce la fricción al trabajar con texto, ya que Gemini limpia automáticamente muletillas ("umm", "ah") y corrige frases a medio decir.
Cómo llegamos aquí
Google lanzó la aplicación nativa de Gemini para macOS en abril de 2026. En junio añadió el agente Spark para tareas como crear documentos. Ahora la actualización con voz (versión 1.88) está disponible globalmente en inglés, con más idiomas previstos para finales de año.
El dato clave
El control por voz tiene dos niveles:
- Dictado inteligente: transcribe el habla en texto limpio en el cursor, activo por defecto.
- Razonamiento con pantalla: opcional, permite que Gemini interprete archivos, imágenes o documentos abiertos para resumir, reescribir o generar imágenes. Ejemplos:
- "Lee estos archivos del veterinario y resume el historial de mi perro en un correo".
- "Convierte estas notas en un resumen ejecutivo con un TL;DR al inicio".
- "Toma esta ilustración y crea una versión en modo oscuro".
Lo que no se dice
Apple ya ofrece dictado nativo y herramientas de edición con Apple Intelligence. La diferencia de Google es combinar ambas funciones con un solo atajo y comprensión de pantalla. Sin embargo, el razonamiento con pantalla requiere permiso explícito del usuario, lo que busca mitigar preocupaciones de privacidad.
Qué sigue
La función se despliega hoy a todos los usuarios de Gemini en macOS. Google promete soporte para más idiomas antes de que termine 2026. Se espera que esta capacidad también llegue a la versión para Windows, aunque la compañía no lo ha confirmado.