Google Cloud presentó Gemini Agent, un agente universal para trabajo con una sola API

La compañía dio a conocer la herramienta en el evento Gemini at Work 2026, con foco en automatizar tareas de conocimiento, creación de contenido y programación, y la posicionó como una plataforma conectable a software corporativo y con controles de seguridad y gobernanza para su uso en organizaciones

spot_img

Google Cloud presentó Gemini Agent, un agente único y universal para el trabajo que responde preguntas, gestiona tareas basadas en el conocimiento, crea imágenes y contenido multimedia, y escribe y ejecuta código a través de un único agente y una sola API.

Durante el evento Gemini at Work 2026, Thomas Kurian, CEO de Google Cloud, describió el alcance de la herramienta: “Gemini cuenta con todo el contexto de su negocio y puede utilizarse para tareas que van desde el trabajo basado en el conocimiento”.

Arquitectura y acceso

Las capacidades de agente se apoyan en principios arquitectónicos que incluyen un agente unificado, acceso omnipresente y ejecución persistente. En la definición presentada, Gemini puede responder durante una conversación, trabajar de forma autónoma para completar objetivos asignados por el usuario y generar código desde una única interfaz.

Publicidad

El acceso se plantea desde distintos dispositivos y canales. La herramienta puede utilizarse vía web, en móviles iOS y Android, y en equipos de escritorio con Windows y Mac. También se prevé su uso a través de línea de comandos, Google Workspace, Microsoft 365 o Slack. Además, puede integrarse en aplicaciones y plataformas de terceros y operar como un agente headless, sin una interfaz de usuario dedicada.

En cuanto a la ejecución persistente, el funcionamiento en la nube mantiene un conjunto de recuerdos, contexto y un gráfico de personalización, independientemente del dispositivo o canal. En ese esquema, las tareas que requieran horas o días continúan ejecutándose incluso después de cerrar el portátil.

Modelos, integración y gobernanza

Gemini Agent incorpora flexibilidad en la elección del modelo subyacente. Ejecuta cada tarea utilizando el modelo óptimo, coordinando actualmente entre la familia de modelos Gemini de Google y los modelos Claude, con la posibilidad de sumar en el futuro otros modelos líderes, tanto privados como abiertos, para optimizar calidad y costos.

En integración, puede conectarse de forma segura con software corporativo y herramientas de colaboración como Confluence, Microsoft Office, Teams, Slack y Workspace; herramientas de desarrollo como Git y Jira; plataformas corporativas como Salesforce y ServiceNow; bases de datos como BigQuery, Databricks, Postgres y Snowflake; y archivos locales. También es compatible con servidores MCP dentro y fuera de la red.

Kurian también vinculó el enfoque con controles de costos y requisitos corporativos: “Selecciona el modelo más adecuado para cada tarea, incorpora controles de costes y, lo que es más importante, ofrece los niveles de seguridad, administración y gobernanza que exige su empresa”.

En seguridad y gobernanza de agentes, se detallaron mecanismos de identidad por agente, permisos granulares basados en roles, auditoría atribuida al agente y ejecución en un entorno aislado (sandbox) con límites de red, con una política de acceso definida una sola vez para aplicarse a todos los agentes de la organización.

spot_img
spot_img
spot_img
spot_img
spot_img
spot_img
spot_img
spot_img
spot_img
spot_img

CONTENIDO RELACIONADO