Glosario de IA
Barreras de seguridad (guardrails)
Comprobaciones y límites que se colocan alrededor de un sistema de IA para que sus entradas y salidas sean seguras, pertinentes y cumplan las normas.
Pueden ser sencillas (una lista de acciones permitidas, un límite de gasto, pedir aprobación humana antes de enviar un correo) o usar otro modelo que revise entradas y salidas en busca de contenido dañino, secretos filtrados o peticiones fuera de tema.
En los agentes, las barreras más eficaces suelen ser los permisos: dale al agente solo las herramientas y accesos que de verdad necesita, y que pida confirmación antes de acciones irreversibles.
Ejemplo: Un agente de compras puede buscar productos y añadirlos al carrito, pero no pagar: el pago exige que una persona lo confirme, y hay un límite de gasto por pedido.
En la práctica
- Combina varias capas: permisos, límites, revisión automática y aprobación humana.
- Prueba tus barreras intentando saltártelas, como haría un atacante.
- Registra lo que hace el agente para poder revisarlo después.
Cómo usar agentes con seguridad: qué es un agente de IA.


