Saltar al contenido
PhiloCyber logo
Volver a todos los recursos

Guía de campo de Red Teaming en IA

Una referencia independiente de proveedores para evaluaciones autorizadas de aplicaciones con LLM, agentes, RAG, MCP, modelos y su infraestructura.

Estado de publicación

Edición v2 revisada

  • Texto canónico en español, con el caso PhiloCorp como recorrido.
  • La edición inglesa conserva su versión anterior.
  • PDF v2 y anexos prácticos disponibles.

Mapa de publicación

Recorré las partes del engagement, elegí una ruta de lectura o abrí los anexos de práctica y consulta.

Edición v2 / 1 de septiembre de 2026

OV-02

Orientar la evaluación

  1. OVGuía práctica de AI Red Teaming, edición PhiloCorp3 min de lecturaLeer capítulo
  2. 00Parte 00 - El encargo2 min de lecturaLeer capítulo
  3. 00Por qué la IA es otra clase de objetivo3 min de lecturaLeer capítulo
  4. 00Categorías de riesgo y RAI4 min de lecturaLeer capítulo
  5. 00Alcance, ROE, ética y marco legal4 min de lecturaLeer capítulo
  6. 00Elegí el recorrido que necesitás2 min de lecturaLeer capítulo
  7. 01Parte 01 - El ecosistema2 min de lecturaLeer capítulo
  8. 01Vocabulario mínimo ML/DL/GenAI4 min de lecturaLeer capítulo
  9. 01Anatomía de un sistema GenAI3 min de lecturaLeer capítulo
  10. 01Taxonomías y frameworks5 min de lecturaLeer capítulo
  11. 02Parte 02 - El plan2 min de lecturaLeer capítulo
  12. 02Metodología operativa (runbook end-to-end)5 min de lecturaLeer capítulo
  13. 02Fases del engagement2 min de lecturaLeer capítulo
  14. 02Assumption register3 min de lecturaLeer capítulo
  15. 02Crown jewels y trust boundaries4 min de lecturaLeer capítulo
  16. 02Attack Intelligence Brief y reporte3 min de lecturaLeer capítulo

03-09

Probar las superficies de ataque

  1. 03Parte 03 - Reconocimiento2 min de lecturaLeer capítulo
  2. 03Recon pasivo y OSINT de stack IA3 min de lecturaLeer capítulo
  3. 03Fingerprinting de modelos3 min de lecturaLeer capítulo
  4. 03Enumeración de superficie agentic/RAG/MCP4 min de lecturaLeer capítulo
  5. 03Validación coordinada de detección en recon3 min de lecturaLeer capítulo
  6. 04Parte 04 - Ataques a LLMs2 min de lecturaLeer capítulo
  7. 04Prompt injection directa2 min de lecturaLeer capítulo
  8. 04Prompt injection indirecta5 min de lecturaLeer capítulo
  9. 04Robustez ante jailbreaks2 min de lecturaLeer capítulo
  10. 04Exposición de contexto oculto2 min de lecturaLeer capítulo
  11. 04Manejo inseguro de salida3 min de lecturaLeer capítulo
  12. 04Consumo no acotado2 min de lecturaLeer capítulo
  13. 04Misinformation y dependencia de respuestas2 min de lecturaLeer capítulo
  14. 04Laboratorio PhiloCorp: inyección, salidas y consumo2 min de lecturaLeer capítulo
  15. 05Parte 05 - Ataques a agentes y sistemas multi-agente2 min de lecturaLeer capítulo
  16. 05Arquitectura de agente y fronteras de confianza2 min de lecturaLeer capítulo
  17. 05Uso indebido de tools y agencia excesiva2 min de lecturaLeer capítulo
  18. 05Integridad y aislamiento de memoria2 min de lecturaLeer capítulo
  19. 05Sistemas multi-agente y delegación2 min de lecturaLeer capítulo
  20. 05Skills agénticas empaquetadas4 min de lecturaLeer capítulo
  21. 05Laboratorio PhiloCorp: autorización, memoria y delegación2 min de lecturaLeer capítulo
  22. 06Parte 06 - Evaluación de seguridad MCP3 min de lecturaLeer capítulo
  23. 06Protocolo MCP e inventario autorizado3 min de lecturaLeer capítulo
  24. 06Integridad de tools: poisoning, cambios y shadowing2 min de lecturaLeer capítulo
  25. 06Límites de permisos y aislamiento MCP2 min de lecturaLeer capítulo
  26. 06Encadenamiento de tools y ejecución inesperada3 min de lecturaLeer capítulo
  27. 06Servidores MCP vulnerables: laboratorio seguro2 min de lecturaLeer capítulo
  28. 06Laboratorio PhiloCorp: integridad y autorización MCP2 min de lecturaLeer capítulo
  29. 07Parte 07 - Evaluación de seguridad RAG y embeddings2 min de lecturaLeer capítulo
  30. 07Integridad del contexto recuperado5 min de lecturaLeer capítulo
  31. 07Integridad de la ingesta RAG5 min de lecturaLeer capítulo
  32. 07Aislamiento de conocimiento y controles de salida5 min de lecturaLeer capítulo
  33. 07Riesgo de reconstrucción desde embeddings5 min de lecturaLeer capítulo
  34. 07Control de acceso al vector store4 min de lecturaLeer capítulo
  35. 07Laboratorio PhiloCorp: procedencia, retrieval y aislamiento4 min de lecturaLeer capítulo
  36. 08Parte 08 - Ataques a datos, modelo y evasión2 min de lecturaLeer capítulo
  37. 08Data poisoning3 min de lecturaLeer capítulo
  38. 08Artefactos ML no confiables y deserialización segura3 min de lecturaLeer capítulo
  39. 08Evasión adversarial3 min de lecturaLeer capítulo
  40. 08Ataques de privacidad y extracción de modelos3 min de lecturaLeer capítulo
  41. 09Parte 09 - Supply chain e infraestructura IA2 min de lecturaLeer capítulo
  42. 09Supply chain de artefactos ML2 min de lecturaLeer capítulo
  43. 09Seguridad cloud para servicios de IA2 min de lecturaLeer capítulo
  44. 09Kubernetes y GPU3 min de lecturaLeer capítulo

10-11

Defender e integrar

  1. 10Parte 10 - Defensa y remediación2 min de lecturaLeer capítulo
  2. 10Guardrails y enforcement de acciones2 min de lecturaLeer capítulo
  3. 10Entrenamiento adversarial y evaluación robusta2 min de lecturaLeer capítulo
  4. 10Privacidad diferencial3 min de lecturaLeer capítulo
  5. 10Tabla de finding a control3 min de lecturaLeer capítulo
  6. 11Parte 11 - Capstones y plantillas2 min de lecturaLeer capítulo
  7. 11Caso A - PhiloCorp Knowledge Agent: del documento a la acción propuesta6 min de lecturaLeer capítulo
  8. 11Caso B - PhiloCorp Model Release Gate: del artefacto a la decisión de promoción5 min de lecturaLeer capítulo
  9. 11Caso C - PhiloCorp Classifier Assurance: evasión, extracción y privacidad6 min de lecturaLeer capítulo
  10. 11Plantillas de engagement3 min de lecturaLeer capítulo
  11. 11Un expediente resuelto: la propuesta que no llegó a ejecutarse4 min de lecturaLeer capítulo
  12. 11Tres láminas para leer la cadena1 min de lecturaLeer capítulo

A-A

Referencia

  1. AMarcos, versiones y matrices de cobertura2 min de lecturaLeer capítulo
  2. AMapeo MITRE ATLAS5 min de lecturaLeer capítulo
  3. AFrameworks, protocolos y tooling5 min de lecturaLeer capítulo
  4. AGlosario7 min de lecturaLeer capítulo
  5. AAnexo - Referencias7 min de lecturaLeer capítulo
  6. ADel expediente al laboratorio5 min de lecturaLeer capítulo
  7. ADecisiones del lector: devolución razonada4 min de lecturaLeer capítulo
  8. AEncontrá la decisión que necesitás1 min de lecturaLeer capítulo
Guía de campo de Red Teaming en IA | PhiloCyber