Fuí al AI Security Bootcamp de Londres con ganas de aprender más sobre seguridad de IA. Ya venía trabajando en algunos de estos problemas y esperaba profundizar en la parte técnica y fundamentos duros de Machine Learning e Inteligencia Artificial... Volví con algo que no había ido a buscar y tampoco esperaba: un sentido y mucha más claridad sobre lo que quiero hacer con mi vida.
Creo que ahí mi ser hizo click, había finalmente encontrado mi propósito (algo que los que me conocen algo más personalmente sabían que venía buscando hacía un tiempo y sin éxito). Me quedó mucho más claro cuánto me importan estas preguntas y cuánto quiero aportar, aunque todavía tenga muchísimo por aprender.
Vengo de la ciberseguridad, sobre todo de seguridad ofensiva, AppSec y, más recientemente, de la seguridad de sistemas que usan IA. Buena parte de mi laburo pasó por preguntas bastante concretas, cosas como: Se puede atacar una aplicación? dónde fallan sus límites de confianza? qué puede hacer un agente con los permisos que le dimos? y cómo llevar esos hallazgos a controles que funcionen de verdad.
Toda esa experiencia me trajo hasta acá. Los proyectos, las certificaciones, las horas de lectura, lo que fui aprendiendo y los problemas que intenté entender son la base desde la que quiero seguir construyendo.

Si querés conocer más sobre el programa, en mi experiencia en AISB cuento cómo fue la semana, qué me costó y qué me traje de Londres te invito a ingresar a este link.
La pregunta se volvió más grande
El bootcamp me ayudó a levantar la mirada y pensar más allá de una aplicación puntual. ¿Cómo hacemos para mantener sistemas de IA cada vez más capaces bajo un control humano significativo? ¿Qué evidencia necesitamos antes de ponerlos en producción? ¿Quién puede decidir frenar cuando esa evidencia no alcanza? ¿Y qué pasa cuando hacerlo choca con la presión por avanzar más rápido?
Son preguntas difíciles, pero lo que me mueve también tiene mucho que ver con lo que espero que la IA nos permita hacer mejor.
No estoy parado en la vereda de los estasicista puros (gente que prioriza estabilidad, control, previsibilidad y reducción de riesgos al máximo) pero si quiero ayudar a que construyamos sistemas útiles y capaces, que mejoren de verdad la vida de las personas, buscar energías renovables, buscar sanar enfermedades incurables, mejorar la realidad de millones de personas, eso nos trae la IA, o al menos, la parte más positiva.
La idea es que que podamos trabajar con estos sistemas cada vez más inteligentes entendiendo qué hacen, dónde fallan y cómo conservar la capacidad de decidir e intervenir. Para mí, reducir los riesgos es parte de hacer que todo esto salga bien mientras el avance y la innovación siguen avanzando (con más recaudos y un ritmo menos acelerado).
En definitiva el bootcamp me llevó más adentro de los modelos: sus fundamentos, reinforcement learning, adversarial ML, backdoors y AI control. Hubo clases que no pude seguir completas y ejercicios de código que exigían más de lo que sabía de machine learning y pytorch. Tocó preguntar, leer mucho, usar IA para explicaciones, y trabajar con compañeros que tenían otras fortalezas, todo esto me ayudó a reconocer mejor dónde necesito crecer invirtiendo tiempo en esos focos específicos.
Mi experiencia en ciberseguridad me sirve, pero no reemplaza esas bases ni las habilidades que necesito para investigar. Me fui con una idea más clara de lo que puedo aportar y de lo que todavía tengo que aprender. En esta parte del camino recién estoy empezando, AI Security en enterprise no es AI Safety y mucho menos AI Engineering.
También me quedaron dando vueltas las conversaciones sobre gobernanza e incentivos. Algunas de esas preguntas antes me parecían lejanas, casi de ciencia ficción. Durante la semana se volvieron mucho más concretas: cómo evaluamos un sistema, qué autoridad le damos y cómo conservamos la capacidad de intervenir. Podés diseñar un control que tenga mucho sentido técnicamente. La pregunta es qué pasa cuando aplicarlo cuesta plata, demora un lanzamiento o va en contra de los incentivos de quienes tienen que tomar la decisión, ya sean los top AI Labs o los países más desarrollados en esto, Estados Unidos y China.
Por eso quiero entender las dos partes: cómo funciona un control y qué hace falta para que alguien realmente lo use cuando importa. Cómo se comprueba que sirve, quién puede exigirlo y cuánto pesa esa evidencia en una decisión real. No tengo una respuesta cerrada para todo eso. Son preguntas en las que quiero trabajar.
Tampoco sé exactamente cómo va a avanzar la IA ni a qué velocidad, y quizás este empezando una carrera ya pérdida (mi tiempo estudiando esto es limitado, la velocidad también sin embargo la IA crece a pasos agigantados constantemente y todo parecería indicar una explosión cognitiva en algunos meses). Pero no necesito conocer todos los futuros posibles para reconocer que este problema me importa y que quiero poner mi esfuerzo acá, dar lo mejor y ver si puedo contribuir con mi granito de arena.
Quiero dedicar mi vida a ayudar a que la IA sea más segura y beneficiosa, entendiendo el alcance e impacto que tiene y que va a tener en un futuro no tan lejano. Poner mi experiencia, mi tiempo y las ganas que tengo de aprender al servicio de ese trabajo. El bootcamp me ayudó a entender eso con una claridad que antes no tenía.
Qué cambia para PhiloCyber
PhiloCyber también fue cambiando conmigo. Empezó como un blog, fue sumando recursos y un canal de YouTube, y después intenté darle forma de consultora (supe tener 3 clientes de diferentes lugares del mundo y trabajar de lo que más me gusta). Esa etapa es parte de la historia del proyecto. Ahora quiero que sea mi espacio personal para escribir, compartir herramientas y recursos y mostrar el trabajo que vaya haciendo en seguridad de IA.
Ya no estoy tomando nuevos trabajos de consultoría a través del sitio. Eso sí: la puerta sigue abierta para investigar con otras personas, colaborar en proyectos, conversar sobre oportunidades de trabajo y obviamente compartir ideas. Cambia la dirección de PhiloCyber, pero las ganas de trabajar con otros van a seguir estando siempre.
Lo que ya hice sigue teniendo un lugar acá. Voy a seguir escribiendo y compartiendo material en el canal de YouTube. Las charlas sobre seguridad de MCP y otros temas también son parte de ese recorrido.
Sigo trabajando en la Guía de campo de Red Teaming en IA y en terminar el Agentic Threat Modeler. Quiero que otras personas puedan usarlos, revisarlos y construir sobre ellos. Compartirlos ya tiene valor por eso, sin que tengan que convertirse en productos comerciales, vive compartir el conocimiento, viva lo open source, y viva buscar un mejor futuro para todos!
Hoy puedo aportar artículos, charlas y recursos prácticos, algunos todavía en desarrollo. Más adelante quiero hacer investigación, por mi cuenta y con otras personas. Empezar por preguntas concretas, aprender a trabajarlas bien y producir algo que otros puedan revisar y criticar.
Quiero que eso se vea con claridad en el sitio... qué hice, en qué estoy trabajando y qué quiero hacer después. Que se pueda distinguir un recurso en desarrollo de un resultado terminado, sin tener que adivinarlo.
Por ahora, el próximo paso es seguir con los recursos que ya están en marcha, fortalecer las bases que me faltan y avanzar hacia una contribución de investigación concreta. Los proyectos y los roles pueden cambiar a medida que aprenda dónde puedo ser más útil. La dirección está clara.
Estoy muy agradecido con quienes hicieron posible el bootcamp, con mis compañeros y con el apoyo económico de BlueDot Impact que me permitió participar. Sin ese apoyo, viajar a Londres para esta semana no habría sido una opción realista para mí. Hacer accesibles estas oportunidades cambia quién puede estar ahí, aprender y aportar. Me traje una idea mucho más clara de qué quiero hacer con la experiencia que ya tengo, y de todo lo que todavía quiero aprender.
Si estás trabajando en algo relacionado y pensás que podemos aportar y sumar juntos, escribime. Si usaste alguno de los recursos y tenés una corrección, una idea o una sugerencia, también avisame! Me interesa escuchar qué te sirvió y qué podríamos mejorar!
Quiero llevar la experiencia que fui construyendo en seguridad al trabajo al que quiero dedicar mi vida.
Gracias como siempre por leer, apoyar y te deseo todo lo mejor donde sea que estés!
Richie


