Saltar al contenido
PhiloCyber logo

Penetration Testing sobre Agentes, LLMs y MCPs

Testing adversarial autorizado sobre tu aplicación de IA, desde prompt injection y abuso de herramientas hasta cadenas completas de exfiltración. Retest incluido.

Alcance
1 a 2 semanas según alcance y complejidad, más 1 semana de retest · Alcance y autorización por escrito, sobre ambientes que no son productivos
Pensado para
Equipos con una funcionalidad de IA ya construida, camino a un lanzamiento, a una revisión de seguridad de un cliente o a una auditoría.
Definamos el alcance del testing
Proceso animado de penetration testing, desde una cadena de explotación autorizada hasta la evidencia y el retestAlcance autorizadoPunto de entradaCadena de ataqueImpactoHallazgoEvidenciaRetesting01Punto de entrada02Cadena de ataque03Impacto04Evidencia05Retesting

Qué hace este servicio

Pruebo la aplicación como sistema: comportamiento del modelo, prompts, RAG, memoria, agentes, herramientas, APIs, identidades y límites de nube. El objetivo no es juntar capturas de jailbreaks. Es demostrar si un atacante puede convertir una interacción débil en acceso no autorizado, exposición de datos o una acción dañina. Es el trabajo que ya vengo haciendo: pentests sobre integraciones MCP, revisiones de seguridad de Skills, y pentests sobre chatbots y sistemas agénticos.

El valor

Sabés qué controles resisten bajo presión, qué fallas son explotables en contexto y qué conviene corregir primero. Cada hallazgo incluye evidencia suficiente para reproducirlo y contexto suficiente para tomar una buena decisión de remediación.

Cómo se trabaja

Empiezo cada trabajo con un alcance y una autorización por escrito. El testing se mantiene dentro de los límites acordados y corre sobre ambientes que no son productivos, salvo autorización explícita en contrario.

Preguntas que este trabajo responde

  • ¿Una entrada no confiable puede cambiar instrucciones o cruzar un límite de confianza?

  • ¿Un agente puede abusar de herramientas, credenciales, memoria o datos conectados?

  • ¿Se pueden encadenar fallas aisladas hasta producir un impacto relevante para el negocio?

Qué recibís

04
  1. D/01Informe técnico con severidad, pasos de reproducción, evidencia y límites de confianza afectados
  2. D/02Narrativas de ataque que conectan el punto de entrada, la cadena de explotación y el impacto demostrado
  3. D/03Guía de remediación priorizada con correcciones prácticas y la decisión de seguridad detrás de cada una
  4. D/04Retest cuando las correcciones estén listas, con evidencia de cierre para el registro final

¿Tenés algo ya en producción sobre lo que no estás seguro?

Contame qué estás construyendo y qué te preocupa. Si es algo en lo que no puedo ayudarte, también te lo digo.

Definamos el alcance del testing
Penetration Testing sobre Agentes, LLMs y MCPs | Ricardo N. Prieto | PhiloCyber