Saltar al contenido
estudIA

Glosario de IA

Barreras de seguridad (guardrails)

Comprobaciones y límites que se colocan alrededor de un sistema de IA para que sus entradas y salidas sean seguras, pertinentes y cumplan las normas.

Pueden ser sencillas (una lista de acciones permitidas, un límite de gasto, pedir aprobación humana antes de enviar un correo) o usar otro modelo que revise entradas y salidas en busca de contenido dañino, secretos filtrados o peticiones fuera de tema.

En los agentes, las barreras más eficaces suelen ser los permisos: dale al agente solo las herramientas y accesos que de verdad necesita, y que pida confirmación antes de acciones irreversibles.

Ejemplo: Un agente de compras puede buscar productos y añadirlos al carrito, pero no pagar: el pago exige que una persona lo confirme, y hay un límite de gasto por pedido.

En la práctica

  • Combina varias capas: permisos, límites, revisión automática y aprobación humana.
  • Prueba tus barreras intentando saltártelas, como haría un atacante.
  • Registra lo que hace el agente para poder revisarlo después.

Cómo usar agentes con seguridad: qué es un agente de IA.

Términos relacionados

Para saber más

← Volver al glosario