Curso · 5 capítulos
IA Adversarial
Lanza funcionalidades LLM que resisten ataques. Defiéndete contra prompt injection, envenenamiento de contexto y jailbreaks, y luego ejecuta un programa interno de red team. 5 capítulos, nivel avanzado, para ingenieros.
Lo que sabrás hacer
- Defiende funcionalidades LLM contra prompt injection
- Refuerza agentes AI contra envenenamiento de datos
- Automatiza pruebas de jailbreak con DeepTeam
- Ejecuta algoritmos de ataque probados como PAIR
- Convierte ataques descubiertos en gates de CI ligeros
- Ejecuta un programa interno de red team de AI
Qué incluye
- 1Adversarial AI: Empieza Aquí
Una orientación por las cuatro etapas del skill path de Adversarial AI — defensor → superficie de amenazas → ofensiva → programa — cubriendo todo desde tu primer parche de prompt injection hasta ejecutar una práctica interna de red team que sobreviva los ataques de 2026.
- 2Fundamentos de defensa contra prompt injection
Por qué existe el prompt injection, cómo lo explotan los atacantes, y la defensa en capas que toda funcionalidad con LLM necesita antes de salir a producción.
- 3Envenenamiento de contexto e inyección indirecta
Mapea y defiende la superficie de ataque de la era de los agentes — envenenamiento de RAG, cargas útiles en documentos, envenenamiento de memoria y secuestro de salidas de herramientas que las defensas contra inyección directa no alcanzan.
- 4Herramientas de Jailbreak Automatizado
LRMs atacantes, patrones de atacante propio (BYO-attacker), el trío DeepTeam / PyRIT / Mindgard y los algoritmos automatizados (PAIR, TAP, GCG) que convierten el red-teaming de una tarea de un solo ingeniero en un programa continuo.
- 5Red teaming de IA y evaluación adversarial
Ejecuta un programa de red team para IA en producción: taxonomía, ciclo de vida de hallazgos, monitoreo en tiempo real, disciplina de regresión y el playbook interno.
Preguntas frecuentes
- ¿Qué aprenderé en este curso de Adversarial AI?
- Aprenderás a defender y atacar sistemas basados en LLM: parchear prompt injection con defensa en profundidad, bloquear el envenenamiento de contexto y la inyección indirecta en RAG y agentes, ejecutar herramientas automatizadas de jailbreak y operar un programa interno de red team de AI. El recorrido abarca cinco capítulos que cubren las etapas de defensor, superficie de amenaza, ofensiva y gestión del programa.
- ¿Para quién es este itinerario de seguridad AI?
- Está diseñado para ingenieros que lanzan funcionalidades LLM en producción y para los equipos de seguridad que las ponen a prueba. El nivel es avanzado, por lo que se asume que ya trabajas con apps LLM, agentes o pipelines RAG.
- ¿Necesito experiencia en código o conocimientos previos de seguridad AI?
- Sí. Es un itinerario de ingeniería avanzado, así que debes sentirte cómodo construyendo funcionalidades LLM y leyendo código. Utiliza herramientas ofensivas como PyRIT, DeepTeam y Mindgard, por lo que te ayudará que te familiarices con herramientas Python.
- ¿Cuánto dura el curso de Adversarial AI y hay certificado?
- El itinerario dura aproximadamente 100 minutos repartidos en cinco capítulos, incluido un capítulo de orientación breve. Obtienes un certificado de finalización una vez que completas todos los capítulos.
- ¿Este curso es gratuito?
- No. Adversarial AI es un itinerario de pago incluido en AI Academy by Anthropos. Cubre la defensa contra prompt injection, el envenenamiento de contexto, herramientas automatizadas de jailbreak y red teaming de AI.
Consigue un certificado
Completa todos los capítulos para recibir tu certificado de finalización.