Gemini ya no quiere limitarse a responder preguntas cuando tú las haces. Google presentó una nueva etapa para su aplicación, con funciones capaces de anticipar necesidades, organizar información y ejecutar tareas bajo tu dirección.
La compañía afirma que Gemini pasó de atender a 400 millones de usuarios mensuales durante Google I/O del año pasado a más de 900 millones en la actualidad, distribuidos en 230 países y más de 70 idiomas.
Gemini adopta un diseño más dinámico
La aplicación estrena Neural Expressive, un lenguaje visual que incorpora animaciones fluidas, colores más intensos, nueva tipografía y retroalimentación háptica en dispositivos compatibles.
Pero el cambio no es solo estético. Google también integró Gemini Live directamente en la aplicación. Ahora puedes comenzar escribiendo una pregunta, pasar a una conversación por voz y volver al texto sin interrumpir el contexto.
El micrófono fue rediseñado para que puedas explicar ideas complejas sin que Gemini te corte a mitad de una frase. Además, la empresa planea añadir dialectos regionales para que las voces resulten más naturales y cercanas a cada usuario.
Las respuestas también podrán incluir imágenes, líneas de tiempo interactivas, videos narrados y gráficos dinámicos. En lugar de mostrar siempre un bloque de texto, Gemini intentará adaptar la forma de presentar la información a cada solicitud.
Neural Expressive comienza a llegar globalmente a la versión web, Android y iOS.
Gemini 3.5 Flash y Gemini Omni amplían las capacidades
Google presentó Gemini 3.5 Flash, el primer modelo de una nueva generación que busca combinar razonamiento avanzado con respuestas y acciones rápidas.
También anunció Gemini Omni, un modelo multimodal que transforma instrucciones de texto, imágenes y videos en producciones audiovisuales de estilo cinematográfico.
Con esta herramienta, podrías subir un video desde tu teléfono y pedir cambios como acercamientos cinematográficos, sustitución de fondos o aplicación de plantillas. La edición se plantea como una conversación, sin exigir conocimientos de programas profesionales.
Gemini Omni también permitirá crear un avatar personalizado con tu apariencia y voz. La función comienza a desplegarse para suscriptores de Google AI Plus, Pro y Ultra en todo el mundo.
Daily Brief organiza tu comienzo del día
¿Y si tu asistente revisara la información importante antes de que abrieras cada aplicación? Esa es la idea detrás de Daily Brief, un agente que prepara un resumen personalizado cada mañana.
Después de activarlo, Gemini puede consultar las aplicaciones conectadas para reunir novedades urgentes de Gmail, próximos eventos de Google Calendar y detalles relacionados con tareas pendientes.
La función no se limita a resumir. También organiza y prioriza la información según tus objetivos, además de sugerir posibles pasos siguientes. Con el tiempo, puedes orientar sus resultados usando respuestas rápidas de aprobación o desaprobación.
Daily Brief comienza a desplegarse para suscriptores de Google AI Plus, Pro y Ultra, inicialmente en Estados Unidos.
Gemini Spark convierte las instrucciones en acciones
El anuncio más ambicioso es Gemini Spark, un agente personal diseñado para trabajar durante todo el día, incluso cuando cierras tu computadora o bloqueas el teléfono.
A diferencia de un chatbot tradicional, Spark busca completar procesos enteros. Está integrado con herramientas de Google Workspace como Gmail, Docs y Slides, y funciona en la nube mediante Gemini 3.5 y el sistema Antigravity.
Entre sus posibles usos están:
- Revisar estados de cuenta mensuales y detectar suscripciones nuevas o cargos inesperados.
- Consultar correos de la escuela de tus hijos, extraer fechas importantes y preparar un resumen diario para ti y tu pareja.
- Analizar notas de reuniones distribuidas entre correos y chats, crear un documento organizado y redactar el mensaje para iniciar el proyecto.
Google también anunció conexiones mediante MCP con servicios como Canva, OpenTable e Instacart. En las próximas semanas, Spark podrá aprovechar esas integraciones para ayudarte a diseñar, reservar o comprar, aunque la disponibilidad dependerá de cada mercado.
La empresa planea añadir más opciones, como enviar mensajes de texto y correos electrónicos a Spark, crear subagentes personalizados y operar el navegador local.
La autonomía no significa control absoluto. Spark estará diseñado para pedir autorización antes de realizar acciones delicadas, como gastar dinero o enviar correos.
Gemini Spark comenzará con un grupo de probadores de confianza y luego llegará como beta a suscriptores estadounidenses de Google AI Ultra.
Gemini Spark también llegará a macOS
Google trabaja en una actualización de su aplicación de Gemini para macOS. Durante el verano, Spark podrá interactuar con archivos locales y automatizar flujos de trabajo directamente en el escritorio.
La aplicación también recibirá nuevas funciones de voz. Gemini podrá aprovechar el contexto visible en la pantalla para convertir una explicación improvisada, con pausas y correcciones, en un texto preciso ubicado justo donde está el cursor.
Por ejemplo, podrías pensar en voz alta sobre una propuesta y pedirle a Gemini que la transforme en un correo formal o en un documento estructurado. La aplicación estaría interpretando tu intención, no simplemente transcribiendo cada palabra.
La app de Gemini para macOS ya está disponible para todos los usuarios. Spark y las nuevas funciones de voz llegarán más adelante durante el verano.
Una IA más útil, pero también más responsable
El anuncio muestra hacia dónde se mueve la inteligencia artificial de consumo: de responder consultas a trabajar en segundo plano, conectar servicios y completar tareas. Eso puede ahorrar tiempo a estudiantes, padres, emprendedores y equipos pequeños que suelen cargar con demasiadas actividades repetitivas.
Pero cuanto más poder tiene un agente, más importante se vuelve definir sus permisos. Revisar un correo no es lo mismo que enviarlo; recomendar una compra no es lo mismo que pagarla. La posibilidad de elegir qué aplicaciones conecta y cuándo debe pedir autorización será clave para generar confianza.
Gemini todavía no es un asistente universal para todos. Varias funciones comienzan en Estados Unidos, dependen de suscripciones específicas y se desplegarán gradualmente. Aun así, la dirección es clara: Google quiere que Gemini no solo te diga qué hacer, sino que te ayude a hacerlo, siempre bajo tu control.
Fuente original
https://blog.google/innovation-and-ai/products/gemini-app/next-evolution-gemini-app
