Google Cloud anunció durante el evento Gemini at Work 2026 Gemini agent, un nuevo agente de inteligencia artificial dirigido a clientes empresariales y presentado como un «agente unificado para el trabajo». La idea principal es que el usuario defina el objetivo en lugar de proporcionar instrucciones detalladas para cada paso, mientras el agente se encarga de analizar la tarea y ejecutarla a través de las aplicaciones y los servicios conectados.
Gemini agent está disponible dentro de la aplicación Gemini Enterprise y Google Workspace, y también puede trabajar con servicios externos. Google Cloud afirma que puede responder preguntas, realizar tareas de conocimiento, crear contenido multimedia, y escribir y ejecutar código.
De asistente personal a miembro del equipo
El agente puede ocuparse de tareas individuales o actuar en nombre de un grupo o de un rol empresarial específico. Entre los ejemplos mostrados por Google se encuentra convertir, con un solo clic, un mensaje de un gerente que solicita las últimas novedades de un proyecto en una presentación de diapositivas, después de que Workspace Intelligence identifica la tarea como delegable.
En otro ejemplo, el usuario puede solicitar la organización de una reunión con un equipo de responsables regionales de eventos sin introducir los nombres ni las direcciones de correo electrónico. Gemini intenta identificar a las personas a partir de la pertenencia al espacio de conversación y del contexto de un debate anterior, después revisa sus calendarios e inicia una cadena de correos para coordinar la cita, incluidos los participantes externos.
Coordinación de modelos y subagentes
Gemini agent funciona en la nube, y Google afirma que selecciona el modelo más adecuado para cada tarea. Las opciones actuales incluyen las familias de modelos Gemini y Claude, con planes de admitir en el futuro otros modelos propios y abiertos. Según el anuncio, este enfoque busca mejorar la calidad de los resultados y reducir los costes.
El agente también utiliza subagentes para ejecutar tareas de varios pasos, y puede coordinar flujos de trabajo que incluyan etapas paralelas o secuenciales capaces de prolongarse durante horas o días. Esto se vincula con herramientas y servicios externos, en lugar de limitar la ejecución a una sola aplicación.
Memoria compartida e integración amplia
La plataforma se basa en un conjunto compartido de memoria, contexto y datos de personalización. Los tipos de memoria identificados por Google incluyen: memoria de sesión para la tarea actual, memoria semántica para construir una base de conocimiento estructurada, memoria procedimental relacionada con la forma de ejecutar el trabajo y memoria episódica que registra lo que el agente ha realizado anteriormente.
El agente puede invocarse mediante @Gemini en Gmail, Docs, Sheets, Slides y Chat. Google también menciona canales como la línea de comandos, Slack y Microsoft 365, y ofrece una API para integrarlo en aplicaciones externas como un agente sin una interfaz específica.
¿Qué cambia en la práctica?
El anuncio traslada a Gemini del modelo de asistente que espera órdenes separadas a un sistema que, en principio, gestiona objetivos y flujos de trabajo prolongados a través de varias herramientas. Sin embargo, la fuente no ofrece detalles sobre los precios, los límites de permisos ni los mecanismos de supervisión y revisión, aspectos importantes para las empresas que puedan delegar en el agente el manejo de sus datos, calendarios y servicios externos.
Gemini agent está disponible actualmente en vista previa privada, y Google Cloud afirma que su lanzamiento amplio comenzará próximamente para los clientes de Workspace suscritos a determinados planes Business y Enterprise.