Google sigue fortaleciendo las funcionalidades de Gemini con nuevas herramientas para facilitar la interacción de los usuarios con su inteligencia artificial. La empresa ha anunciado la llegada de un renovado sistema de control por voz para computadoras Mac, que permite dictar órdenes de manera más fluida y realizar tareas complejas sin necesidad de saltar entre aplicaciones.
La nueva opción, disponible inicialmente únicamente para equipos Apple, forma parte de la estrategia presentada en Google I/O 2026, donde la compañía adelantó su plan de convertir a Gemini en un asistente que entiende el contexto del usuario y ejecuta acciones mediante conversaciones naturales.
Además del dictado mejorado, la actualización incluye capacidades avanzadas de razonamiento, análisis de documentos y generación de contenido, acercando a Gemini a un asistente digital capaz de trabajar con diferentes aplicaciones y archivos.

Sistema de dictado renovado para controlar Gemini por voz
La característica más destacada es un sistema de dictado optimizado. Al mantener presionada la tecla Fn en una Mac, se activa Gemini y el usuario puede hablar de forma natural para indicar lo que desea.
Desde ese instante, la IA analiza el contexto y decide si la acción debe realizarse en la ventana activa o si requiere acceder a otra aplicación del sistema.
Google indicó que su meta es minimizar la escritura de instrucciones y lograr que la interacción con Gemini se asemeje a una charla con otra persona. Además, la herramienta mejorará la calidad del texto generado con dictado.
De acuerdo con la empresa, Gemini suprimirá automáticamente muletillas, pausas y expresiones coloquiales, transformándolos en un texto limpio, coherente y preparado para usar en documentos, correos u otras apps.

Funciones avanzadas para tareas complejas en Gemini
La actualización añade un modo de razonamiento avanzado para realizar acciones que necesitan analizar varias fuentes de datos.
Entre las novedades, sobresale la habilidad de leer archivos del escritorio, examinar documentos e imágenes, y elaborar resúmenes automáticos con los datos clave.
Incluso se podrá solicitar que procese múltiples archivos al mismo tiempo y redacte un correo con las conclusiones. Google presentó ejemplos enfocados en productividad.
La IA podrá analizar el estilo de escritura de cada usuario para generar textos que mantengan su forma de redactar, útil para informes, documentos laborales o académicos.

Asimismo, las herramientas de creación y edición de imágenes contarán con nuevas opciones para producir contenido visual con mayor precisión y flexibilidad.
Meta: que Gemini se convierta en un asistente digital completo
Estas actualizaciones responden a la estrategia de Google desde el lanzamiento de Gemini.
La compañía pretende que su IA pase de ser un chatbot tradicional a un asistente que entienda el contexto laboral del usuario, acceda a diversas apps y ejecute tareas de manera integrada.
En Google I/O 2026, explicaron que buscan que Gemini funcione como un «copiloto» digital, combinando instrucciones escritas, comandos de voz y acciones automatizadas en una sola experiencia.
Con estas capacidades, los usuarios podrían ahorrar tiempo en tareas repetitivas, automatizar procesos y manejar información desde una sola interfaz.

Despliegue progresivo de las nuevas funciones
Por ahora, las nuevas características solo están disponibles en computadoras Mac.
Google no ha informado cuándo estarán disponibles para Windows u otros sistemas, por lo que los usuarios de esas plataformas deberán aguardar próximas actualizaciones. El lanzamiento inicial se limitará al inglés.
La compañía explicó que, como es habitual, primero evaluará el rendimiento en ese idioma para luego expandir la compatibilidad a otros, como el español.
Aunque no hay una fecha oficial, Google señaló que el despliegue internacional se hará de forma gradual durante las próximas semanas.
Fuente: Infobae