Curso · 5 capítulos

IA Adversarial

Lanza funcionalidades LLM que resisten ataques. Defiéndete contra prompt injection, envenenamiento de contexto y jailbreaks, y luego ejecuta un programa interno de red team. 5 capítulos, nivel avanzado, para ingenieros.

De pagoadvanced5 capítulos100 minInglés + 6 idiomasCertificado al completar

Lo que sabrás hacer

  • Defiende funcionalidades LLM contra prompt injection
  • Refuerza agentes AI contra envenenamiento de datos
  • Automatiza pruebas de jailbreak con DeepTeam
  • Ejecuta algoritmos de ataque probados como PAIR
  • Convierte ataques descubiertos en gates de CI ligeros
  • Ejecuta un programa interno de red team de AI

Qué incluye

  1. 1
    Adversarial AI: Empieza Aquí

    Una orientación por las cuatro etapas del skill path de Adversarial AI — defensor → superficie de amenazas → ofensiva → programa — cubriendo todo desde tu primer parche de prompt injection hasta ejecutar una práctica interna de red team que sobreviva los ataques de 2026.

    12 min
  2. 2
    Fundamentos de defensa contra prompt injection

    Por qué existe el prompt injection, cómo lo explotan los atacantes, y la defensa en capas que toda funcionalidad con LLM necesita antes de salir a producción.

    22 min
  3. 3
    Envenenamiento de contexto e inyección indirecta

    Mapea y defiende la superficie de ataque de la era de los agentes — envenenamiento de RAG, cargas útiles en documentos, envenenamiento de memoria y secuestro de salidas de herramientas que las defensas contra inyección directa no alcanzan.

    22 min
  4. 4
    Herramientas de Jailbreak Automatizado

    LRMs atacantes, patrones de atacante propio (BYO-attacker), el trío DeepTeam / PyRIT / Mindgard y los algoritmos automatizados (PAIR, TAP, GCG) que convierten el red-teaming de una tarea de un solo ingeniero en un programa continuo.

    22 min
  5. 5
    Red teaming de IA y evaluación adversarial

    Ejecuta un programa de red team para IA en producción: taxonomía, ciclo de vida de hallazgos, monitoreo en tiempo real, disciplina de regresión y el playbook interno.

    22 min

Preguntas frecuentes

¿Qué aprenderé en este curso de Adversarial AI?
Aprenderás a defender y atacar sistemas basados en LLM: parchear prompt injection con defensa en profundidad, bloquear el envenenamiento de contexto y la inyección indirecta en RAG y agentes, ejecutar herramientas automatizadas de jailbreak y operar un programa interno de red team de AI. El recorrido abarca cinco capítulos que cubren las etapas de defensor, superficie de amenaza, ofensiva y gestión del programa.
¿Para quién es este itinerario de seguridad AI?
Está diseñado para ingenieros que lanzan funcionalidades LLM en producción y para los equipos de seguridad que las ponen a prueba. El nivel es avanzado, por lo que se asume que ya trabajas con apps LLM, agentes o pipelines RAG.
¿Necesito experiencia en código o conocimientos previos de seguridad AI?
Sí. Es un itinerario de ingeniería avanzado, así que debes sentirte cómodo construyendo funcionalidades LLM y leyendo código. Utiliza herramientas ofensivas como PyRIT, DeepTeam y Mindgard, por lo que te ayudará que te familiarices con herramientas Python.
¿Cuánto dura el curso de Adversarial AI y hay certificado?
El itinerario dura aproximadamente 100 minutos repartidos en cinco capítulos, incluido un capítulo de orientación breve. Obtienes un certificado de finalización una vez que completas todos los capítulos.
¿Este curso es gratuito?
No. Adversarial AI es un itinerario de pago incluido en AI Academy by Anthropos. Cubre la defensa contra prompt injection, el envenenamiento de contexto, herramientas automatizadas de jailbreak y red teaming de AI.

Consigue un certificado

Completa todos los capítulos para recibir tu certificado de finalización.