Google Cloud a annoncé lors de l’événement Gemini at Work 2026 Gemini agent, un nouvel agent d’intelligence artificielle destiné aux entreprises et présenté comme un « agent unifié pour le travail ». L’idée principale est que l’utilisateur définisse l’objectif au lieu de fournir des instructions détaillées pour chaque étape, tandis que l’agent se charge d’analyser la tâche et de l’exécuter via les applications et services connectés.
Gemini agent est disponible dans l’application Gemini Enterprise et Google Workspace, et peut également fonctionner avec des services externes. Google Cloud affirme qu’il peut répondre aux questions, accomplir des tâches de nature cognitive, créer des contenus multimédias, ainsi qu’écrire et exécuter du code.
De l’assistant personnel au membre de l’équipe
L’agent peut traiter des tâches individuelles ou agir au nom d’un groupe ou d’un rôle précis au sein de l’entreprise. Parmi les exemples présentés par Google, il peut transformer en un clic un message d’un responsable demandant les dernières avancées d’un projet en présentation de diapositives, après que Workspace Intelligence a identifié la tâche comme pouvant être déléguée.
Dans un autre exemple, l’utilisateur peut demander l’organisation d’une réunion avec une équipe de responsables régionaux des événements sans saisir les noms ni les adresses e-mail. Gemini tente d’identifier les personnes à partir des membres de l’espace de conversation et du contexte d’une discussion précédente, puis consulte leurs calendriers et lance un échange par e-mail pour coordonner la date, y compris avec les participants externes.
Orchestration de modèles et d’agents secondaires
Gemini agent fonctionne dans le cloud, et Google affirme qu’il sélectionne le modèle le plus adapté à chaque tâche. Les options actuelles comprennent les familles de modèles Gemini et Claude, avec des projets visant à prendre en charge à l’avenir d’autres modèles propriétaires et ouverts. Selon l’annonce, cette approche vise à améliorer la qualité des résultats et à réduire les coûts.
L’agent utilise également des agents secondaires pour exécuter des tâches en plusieurs étapes et peut orchestrer un flux de travail comprenant des étapes parallèles ou séquentielles susceptibles de se prolonger pendant des heures ou des jours. Cette capacité s’appuie sur des outils et services externes plutôt que de limiter l’exécution à une seule application.
Mémoire partagée et intégration étendue
La plateforme repose sur un ensemble partagé de mémoire, de contexte et de données de personnalisation. Les types de mémoire définis par Google comprennent : la mémoire de session pour la tâche actuelle, la mémoire sémantique destinée à constituer une base de connaissances structurée, la mémoire procédurale liée à la manière d’exécuter le travail, et la mémoire épisodique qui consigne ce que l’agent a déjà accompli.
L’agent peut être appelé via @Gemini dans Gmail, Docs, Sheets, Slides et Chat. Google mentionne également des canaux tels que la ligne de commande, Slack et Microsoft 365, et fournit une API permettant de l’intégrer à des applications externes en tant qu’agent sans interface dédiée.
Qu’est-ce qui change concrètement ?
L’annonce fait évoluer Gemini, qui passe du modèle de l’assistant attendant des commandes distinctes à celui d’un système censé gérer des objectifs et des flux de travail étendus à plusieurs outils. Toutefois, la source ne fournit pas de détails sur les tarifs, les limites d’autorisation ni les mécanismes de supervision et de révision, autant de points importants pour les entreprises susceptibles de déléguer à l’agent l’accès à leurs données, calendriers et services externes.
Gemini agent est actuellement disponible en préversion privée, et Google Cloud indique que son déploiement à plus grande échelle débutera prochainement pour les clients Workspace abonnés à certains forfaits Business et Enterprise.