Laboratorio de ataques de seguridad
Un agente servicial puede volverse en tu contra. ¿Cómo lo logran los atacantes, y cómo los detienes?
La idea que hay dentro
Inyección, agencia excesiva, exfiltración de datos, salida insegura: rompe cada cadena con una defensa.
Después de esta lección
Puedes reconocer prompt injection, agencia excesiva, exfiltración de datos y manejo inseguro de la salida, y la defensa que neutraliza cada uno (OWASP LLM Top 10).
Adónde lleva
Dentro de esta lección
Ese es el escenario real de la lección, en pausa. Reclama tu pase para operarlo.
Mira cómo funciona la IA de verdad, de principio a fin.
Esta lección es solo una parada del arco completo. Desbloquéalo todo y consérvalo de por vida.
Lo que obtienes
- El camino principal de 34 lecciones, una ruta que sí se termina, de una palabra a los agentes
- Rutas por objetivo para usar IA en el trabajo y construir funciones con IA
- Labs de jefe que te hacen aplicar un acto entero, no solo reconocerlo
- Repaso espaciado que trae cada idea de vuelta antes de que la olvides
- Memoria del curso: cada término definido, con enlaces a donde aparece por primera vez
- Una tarjeta de capacidades para compartir cuando termines el camino principal
- Acceso de por vida en cualquier dispositivo, con todas las lecciones futuras incluidas
No son videos para mirar. Predices, operas la máquina y luego lo demuestras. Por eso se queda.
99 lecciones y retos interactivos. Sin videos, sin código.
Pase de lanzamiento gratis: acceso de por vida, sin tarjeta
¿Nuevo por aquí? Las primeras lecciones son gratis para probar. Empieza con la lección 0.1
Qué muestra esta lección
Inyección, agencia excesiva, exfiltración de datos, salida insegura: rompe cada cadena con una defensa.
La pregunta con la que abre
Un agente servicial puede volverse en tu contra. ¿Cómo lo logran los atacantes, y cómo los detienes?
El recorrido, en palabras de la propia lección
- La corriente está secuestrada. Toca la guardia en el cable para reparar el flujo.
- Cuatro circuitos, cuatro guardias. Un cable reparado detiene cada daño.
- Nuevo circuito, nuevo ataque. Toca la guardia en el cable para reparar el flujo.
- Advertencia honesta: nadie ha encontrado una forma de imponer del todo esta frontera. Ayuda, pero las guardias con las que SÍ puedes contar son las otras dos: privilegios acotados y envíos con compuerta.
- Estos cuatro no son al azar. Cada uno es una categoría del OWASP Top 10 para Aplicaciones LLM, la lista compartida del campo sobre cómo se ataca a las apps de IA:
- Los sistemas reales apilan varias guardias, porque ninguna sola es perfecta. Pero ver el circuito te dice dónde va siquiera una guardia.
- Una advertencia honesta sobre el circuito 1: nadie ha encontrado una forma fiable de hacer que un modelo trate el texto descargado puramente como datos. Las instrucciones y los datos comparten una misma ventana, así que esa frontera ayuda pero no se puede imponer del todo dentro del modelo. Las guardias con las que sí puedes contar son arquitectónicas: quítale privilegios al agent mientras lee contenido no confiable y controla lo que sale.
- Y cuando datos privados, contenido no confiable y una vía para enviar datos fuera se juntan en un mismo agent, esa combinación tiene nombre: la trifecta letal. La lección 7.7 la desarma pata por pata.
- Le estás dando a un agente una tool que puede leer la bandeja de entrada de un cliente y enviar correo en su nombre. ¿Dónde van las guardias?
- Traza el circuito. Trata el correo recuperado como datos, no como instrucciones (prompt injection); acota la tool de envío a borradores o a una lista corta de permitidos, no a destinatarios arbitrarios (agencia excesiva); y exige aprobación antes de que salga nada (exfiltración de datos). Apílalas, porque ninguna guardia sola alcanza.
La idea clave
Puedes detectar los ataques comunes a agentes y colocar la defensa que rompe cada uno.
Qué puedes hacer después de esta lección
Puedes reconocer prompt injection, agencia excesiva, exfiltración de datos y manejo inseguro de la salida, y la defensa que neutraliza cada uno (OWASP LLM Top 10).
Este es el resumen escrito. La lección en sí es interactiva: arriba predices, arrastras y operas el mecanismo, y la revelación te responde.