Google amplía la función Gemini Live, que pasa de ser una conversación de voz a ejecutar tareas prácticas mediante sus aplicaciones. Ahora el usuario puede hablar con el asistente para organizar ideas en documentos, resumir mensajes de Gmail, gestionar la agenda diaria o delegar proyectos de varios pasos que se ejecutan en segundo plano. La empresa afirma que el 63% de los usuarios habla con Gemini en voz alta, algo que presenta como una de las razones de esta actualización.
De la conversación a la ejecución de tareas
Gemini Live se integra con Spark, una función que ejecuta comandos de voz complejos mediante Google Docs, Sheets, Drive y la web. Según Google, Spark puede recordar el objetivo durante el trabajo y ejecutar tareas largas o programadas durante días o semanas, incluso cuando el usuario no está utilizando activamente la aplicación.
La empresa ofrece como ejemplo la transformación de una conversación desordenada en un esquema organizado dentro de Google Docs. El usuario también puede solicitar la preparación de un menú semanal vegetariano rico en proteínas y crear una lista de compras basándose en recetas guardadas en sus documentos. Estos usos no se limitan a generar una respuesta de texto, sino que conectan el comando de voz con una acción dentro de otra aplicación o con una serie de acciones.
Resumen de voz del día y gestión del correo
Google añade a Gemini Live la función Daily Brief, que ofrece un breve resumen de voz de los elementos más importantes del día procedentes de Gmail y Calendar. El usuario puede activarla preguntando: «¿Cuál es mi resumen de hoy?», para obtener una vista rápida de las tareas y actualizaciones sin abrir la pantalla.
La nueva función de gestión del correo también permite buscar y resumir mensajes, marcarlos con una estrella, archivarlos o eliminarlos mediante comandos de voz. Entre los ejemplos que menciona Google se encuentran preguntar por los mensajes nuevos o por mensajes urgentes de la escuela de los niños. El material no especifica detalles adicionales sobre los mecanismos de confirmación antes de eliminar mensajes ni sobre los límites para ejecutar estos comandos.
Personalización de las respuestas mediante los datos del usuario
Personal Intelligence permite que Gemini Live utilice conversaciones anteriores y datos de aplicaciones conectadas, incluidas Gmail, Photos, Search y YouTube. De este modo, el usuario puede formular preguntas basadas en un contexto previo, como recordar el nombre de un restaurante que visitó en un viaje anterior o recuperar una receta mencionada en una conversación pasada.
Para comenzar, es necesario seleccionar las aplicaciones que el usuario desea vincular desde la configuración de Gemini Personal Intelligence y, después, pulsar el icono de Live en la aplicación Gemini. Este paso muestra que el aprovechamiento de las funciones depende de activar las conexiones de las aplicaciones, no solo de la conversación de voz.
¿Qué cambia en la práctica?
El valor principal de la actualización consiste en reunir distintas herramientas dentro de una sola conversación. En lugar de determinar si una tarea requiere buscar en Gmail, crear un evento en Calendar o ejecutar Spark, el usuario puede continuar con la solicitud mediante la voz, mientras Gemini se encarga de dirigir las partes correspondientes a las herramientas disponibles. En el ejemplo que presenta Google, la solicitud comienza con un resumen de la agenda y el correo, y después pasa a extraer invitaciones de los mensajes, crear eventos en el calendario familiar y añadir tiempos de desplazamiento.
Sin embargo, esta ampliación también aumenta la importancia de revisar los permisos y los resultados antes de confiar en acciones que afecten al correo, el calendario o los archivos. El material no menciona detalles sobre el alcance geográfico de la disponibilidad, los límites del número de tareas ni las políticas de conservación de datos. Además, Spark está disponible con una suscripción a Google AI Pro o superior, mientras que Daily Brief requiere una suscripción a Google AI Plus o superior. Google describe el contenido generado por inteligencia artificial en la página como experimental, lo que exige considerar tanto los resultados como la ejecución automatizada como elementos que necesitan verificación por parte del usuario.