Penetration Testing sobre Agentes, LLMs y MCPs
Testing adversarial autorizado sobre tu aplicación de IA, desde prompt injection y abuso de herramientas hasta cadenas completas de exfiltración. Retest incluido.
- Alcance
- 1 a 2 semanas según alcance y complejidad, más 1 semana de retest · Alcance y autorización por escrito, sobre ambientes que no son productivos
- Pensado para
- Equipos con una funcionalidad de IA ya construida, camino a un lanzamiento, a una revisión de seguridad de un cliente o a una auditoría.
Qué hace este servicio
Pruebo la aplicación como sistema: comportamiento del modelo, prompts, RAG, memoria, agentes, herramientas, APIs, identidades y límites de nube. El objetivo no es juntar capturas de jailbreaks. Es demostrar si un atacante puede convertir una interacción débil en acceso no autorizado, exposición de datos o una acción dañina. Es el trabajo que ya vengo haciendo: pentests sobre integraciones MCP, revisiones de seguridad de Skills, y pentests sobre chatbots y sistemas agénticos.
El valor
Sabés qué controles resisten bajo presión, qué fallas son explotables en contexto y qué conviene corregir primero. Cada hallazgo incluye evidencia suficiente para reproducirlo y contexto suficiente para tomar una buena decisión de remediación.
Cómo se trabaja
Empiezo cada trabajo con un alcance y una autorización por escrito. El testing se mantiene dentro de los límites acordados y corre sobre ambientes que no son productivos, salvo autorización explícita en contrario.
Sobre esto hablé
MCP Security for Enterprise Organizations, Ekoparty 2025Preguntas que este trabajo responde
¿Una entrada no confiable puede cambiar instrucciones o cruzar un límite de confianza?
¿Un agente puede abusar de herramientas, credenciales, memoria o datos conectados?
¿Se pueden encadenar fallas aisladas hasta producir un impacto relevante para el negocio?
Qué recibís
04- D/01Informe técnico con severidad, pasos de reproducción, evidencia y límites de confianza afectados
- D/02Narrativas de ataque que conectan el punto de entrada, la cadena de explotación y el impacto demostrado
- D/03Guía de remediación priorizada con correcciones prácticas y la decisión de seguridad detrás de cada una
- D/04Retest cuando las correcciones estén listas, con evidencia de cierre para el registro final
Todos los servicios
¿Tenés algo ya en producción sobre lo que no estás seguro?
Contame qué estás construyendo y qué te preocupa. Si es algo en lo que no puedo ayudarte, también te lo digo.

