Skip to content
PhiloCyber logo
PhiloCyber / research archive

Field notes from the changing AI attack surface.

Technical research, practical experiments and clear analysis for the people building and securing LLM applications, agents and MCP systems.

Latest dispatchAug 01, 2026
#AI Security

El Agente que Hackeó Hugging Face para 'Copiarse' en un Examen (versión sin humo)

17.600 acciones, cuatro días y medio, cinco límites de confianza rotos y 100% automatizado (ningún humano tipeando comandos). No fue una IA que se volvió mala, al estilo Skynet: fue un optimizador al que le dejaron todas las puertas abiertas. Acá está la cadena completa, paso por paso, separando lo confirmado de lo que todavía nadie publicó.

Read Article
Evidence / contextPhiloCyber / 18

Selected from the archive

Research worth spending time with.

Blog | PhiloCyber | Ricardo N. Prieto | PhiloCyber