Saltar al contenido
El banco de pruebas

Gobernar agentes de IA autónomos

Hasta ahora la IA contestaba y una persona actuaba. Con Gemini agent y Copilot Autopilot, la IA actúa: escribe, agenda y mueve documentos durante horas, con su propia cuenta. Lo que había que decidir era dónde iban los datos; ahora además hay que decidir permisos, gasto y quién responde.

A la izquierda, el robot de Copilot camina con su maletín junto a unos buzones; a la derecha, el robot de Gemini monta un pequeño agente de módulos.

En una frase

Un agente que trabaja solo se gobierna como una incorporación con acceso a vuestros sistemas: identidad propia, permisos mínimos, tope de gasto, registro de lo que hace, una lista de lo que nunca hace solo y una persona que responde de él y lo puede parar.

Aether Labs es un estudio de IA de Barcelona que implanta la IA por departamentos en pymes y empresas medianas de toda España: entra en un departamento, mide cómo se trabaja, monta la IA sobre sus documentos y sus herramientas, forma a cada puesto sobre su trabajo y se va cuando alguien de dentro lo mantiene. Cuando lo que se monta es un agente que trabaja solo, estos nueve controles van en el mismo trabajo.

Por qué esto es nuevo

En dos semanas han llegado los dos agentes que van a entrar en casi todas las oficinas. Autopilot, de Microsoft, el 25 de septiembre de 2026: un agente con nombre, rol y objetivo que vive en Teams y Outlook y sigue trabajando aunque no estés. Gemini agent, de Google, el 8 de octubre: le das un objetivo y vuelve con el trabajo hecho, y sus agentes compañeros tienen su propia cuenta y su propio correo.

Los dos están en preview, y los dos vienen dentro de Microsoft 365 y de Google Workspace, que es donde ya trabajan las empresas medianas. Y los dos cambian la pregunta. Con un chat, lo importante era dónde iban los datos. Con un agente que actúa durante horas, lo importante es qué puede hacer, con qué cuenta, cuánto puede gastar y quién responde.

Los nueve controles

Lo que hay que decidir antes de encender el primero, con la pregunta que lo resume:

1. Identidad propia

¿Actúa como él mismo o con la cuenta de alguien? Como él mismo, siempre. Los dos lo permiten: Google da a cada agente compañero su cuenta y su correo, y el Autopilot vive en vuestro entorno de Microsoft con su propia identidad. Si un agente usa la cuenta de una persona, nadie puede saber después quién hizo qué.

2. Permisos mínimos

¿Qué puede abrir y qué puede tocar? Lo justo para su rol. Se empieza en solo lectura y se le comparte una carpeta, no la unidad entera. El agente de Google solo ve lo que se le comparte; el permiso de escribir o de enviar se da solo para las tareas que lo piden.

3. Lo compartido de más

¿Qué está abierto a toda la empresa sin que nadie lo recuerde? Antes de encender, se revisa. Un agente que trabaja horas encuentra lo que un empleado olvidó cerrar, y lo usa. Los documentos sensibles se etiquetan para que las políticas puedan bloquearlos.

4. Tope de gasto

¿Quién paga cada tarea y dónde se para? Los dos cobran por consumo, y el coste de cada tarea varía con lo que haga. En Google se pone un tope por proyecto y el agente se pausa al llegar. En Microsoft, nada se cobra hasta que un administrador crea una política de gasto, y esa política añade sola los servicios nuevos, salvo que se desactive esa opción.

5. Registro de lo que hace

¿Queda escrito, y alguien lo lee? Los dos dejan un registro de cada acción a nombre del agente. Hace falta decidir quién lo revisa y cada cuánto; un registro que nadie mira no gobierna nada.

6. Lo que nunca hace solo

¿Dónde tiene que aprobar una persona? Se escribe la lista antes de empezar: pagos, envíos a clientes, contratos, decisiones sobre personas. El agente prepara y una persona aprueba.

7. Instrucciones escondidas

¿Qué pasa si lee un correo preparado para engañarle? Puede obedecerlo: la inyección de instrucciones no está resuelta. Un agente que lee correo de fuera no debería poder enviar ni pagar sin revisión.

8. Qué modelo corre debajo

¿Quién procesa vuestros datos, y dónde? El agente de Google elige entre los modelos de Gemini y los de Claude; en Microsoft, los modelos de Anthropic se aprueban a mano en el centro de administración. Es una decisión para tomar con quien lleva la protección de datos.

9. Un responsable y un botón de parar

¿Quién lo pausa, y quién lo mantiene? Una persona dentro del departamento, que sabe pausarlo y que revisa cada mes permisos, gasto y registro. Están en preview: se prueba en un departamento, no en toda la empresa a la vez.

Qué trae cada plataforma

Google (Gemini agent)

  • Cada agente con su identidad y permisos mínimos, aprobados por los administradores de seguridad.
  • Los agentes compañeros, con cuenta de Workspace, correo, calendario y Drive propios; solo ven lo que se les comparte.
  • Un entorno aislado con su propio perímetro de red, y un cortafuegos que aplica vuestras políticas a todo lo que entra, sale y pasa entre agentes.
  • Un registro de cada acción, a nombre del agente.
  • Un tope de gasto por proyecto: al llegar, el agente se pausa. El gasto se puede imputar a cada departamento.

Microsoft (Autopilot)

  • Cada Autopilot con su identidad, memoria, ordenador y espacio de trabajo dentro de vuestro Microsoft 365, con permisos, registro y gobierno detrás.
  • Una política de gasto en Créditos Copilot, con límites por empresa y por persona y avisos. Viene con la opción de añadir solos los servicios nuevos: se apaga si queréis decidirlo vosotros.
  • Los modelos de terceros, como los de Anthropic, se aprueban a mano: el programa Frontier nunca los activa por vosotros.
  • En preview, sin el soporte ni el acuerdo de nivel de servicio habituales.

Las piezas vienen de fábrica. Lo que no viene es la decisión: qué rol tiene cada agente, qué carpeta ve, cuánto puede gastar, qué no hace nunca solo y quién mira el registro. Eso se decide en cada departamento.

El reglamento europeo de IA, sin alarmismo

El reglamento no trata a los agentes aparte: cuenta para qué se usan. Desde febrero de 2025 obliga a tomar medidas para que quien usa IA sepa usarla, y desde el 3 de agosto de 2026 las autoridades nacionales supervisan. Las obligaciones de alto riesgo se aplazaron a 2027 y 2028, y entre esos usos está la selección de personal: un agente que ordena candidaturas tiene que dejar la decisión a una persona. El detalle, en gobernanza de datos con IA.

Cómo lo hacemos

  • Implantar el primero. Con la adopción de IA: tres semanas dentro de un departamento, donde se elige el rol, se ponen los nueve controles, se prueba con el equipo y se deja a un responsable interno.
  • Gobernarlo cada mes. Con el AI Partner: revisar permisos, gasto y registro, y lo que cambia en cada actualización, que con dos productos en preview es casi todo.
  • Construir lo que no viene. Si el trabajo pide un agente que ni Google ni Microsoft traen, se construye a medida en el laboratorio, con los mismos controles.

Preguntas frecuentes

¿Qué es gobernar un agente de IA?

Decidir antes de encenderlo con qué identidad actúa, qué puede abrir y tocar, cuánto puede gastar, qué queda registrado, qué no hace nunca sin que apruebe una persona y quién lo vigila y lo puede parar. Con un chat bastaba con saber dónde iban los datos; un agente que actúa solo pide además permisos, gasto y responsable.

¿Por qué un agente autónomo necesita identidad propia?

Porque si usa la cuenta de una persona, después nadie puede saber qué hizo el agente y qué hizo la persona. Gemini agent da a cada agente compañero su propia cuenta de Workspace y Autopilot vive en Microsoft 365 con su propia identidad; los dos registran cada acción a nombre del agente.

¿Cómo se controla lo que gasta un agente de IA?

Con un tope. En Google se pone un límite de gasto por proyecto y el agente se pausa al llegar. En Microsoft, un administrador crea una política de gasto en Créditos Copilot, con límites y avisos, y conviene apagar la opción que añade solos los servicios nuevos a esa política.

¿Qué no debe hacer nunca solo un agente de IA?

Lo que no tiene vuelta atrás o compromete a la empresa: pagar, enviar algo a un cliente, firmar o cambiar un contrato y decidir sobre personas. El agente lo prepara y una persona lo aprueba. La lista se escribe por departamento antes de empezar.

¿Qué dice el reglamento europeo de IA de los agentes?

No trata a los agentes aparte: cuenta para qué se usan. Desde febrero de 2025 obliga a tomar medidas para que quien usa IA sepa usarla, y la selección de personal es uno de los usos de alto riesgo, cuyas obligaciones se aplazaron a 2027 y 2028. Un agente que ordena candidaturas tiene que dejar la decisión a una persona.

Fuentes

Gemini agent: qué es y qué se le encarga→

Copilot Autopilot: qué es y qué se le encarga→

Gobernanza de datos con IA→

Contadnos en qué departamento pondríais el primer agente→

Escrito por Víctor Torres, fundador de Aether Labs. Publicado el 9 de octubre de 2026.

Sigue leyendo

Guía

¿Qué es Gemini agent y cómo se implanta y se gobierna en una empresa?

9 min de lectura
Guía

¿Qué es Copilot Autopilot y cómo se implanta y se gobierna en una empresa?

9 min de lectura
Concepto

Qué es un agente de IA (y qué no es)

6 min de lectura