"Si tú no trabajas por tus sueños, alguien te contratará para que trabajes por los suyos”

Steve Jobs

Afiliado
Dominios3Euros

Un informático en el lado del mal

Blog personal de Chema Alonso sobre sus cosas.
  1. Hoy os voy a contar lo que en FardaySec aprendimos construyendo un Pentester Autónomo basado en Inteligencia Artificial para hacer Continuos Attack a las empresas como parte de la gestión de la seguridad en el mundo de hoy. La confianza en el Pentesting Autónomo no se resuelve con un modelo más grande — se resuelve con evidencia, trazabilidad y gobernanza. Por eso el futuro no es Inteligencia Artificial reemplazando al pentester, o hacker, sino teniendo al hacker + Agente IA trabajando juntos.


    Hace aproximadamente un año y medio empezamos en Faraday con una pregunta bastante simple:

    ¿Hasta dónde podemos automatizar realmente el trabajo de un pentester utilizando Inteligencia Artificial?

    No queríamos construir otro scanner. Tampoco un chatbot capaz de explicar vulnerabilidades. Queríamos darle a un agente un objetivo, herramientas ofensivas reales y suficiente autonomía para investigar, tomar decisiones y producir evidencias. Después de 157 engagements autónomos, más de 117.000vulnerabilidades procesadas y más de 250 horas de testing, aprendimos algo que inicialmente no era tan evidente:

    Encontrar vulnerabilidades no terminó siendo el problema más difícil.

    El problema difícil fue decidir cuándo podíamos confiar en lo que el agente decía haber encontrado. Esta es probablemente la principal lección que nos dejó construir FaradAI.

    Un LLM no es un pentester

    Al principio parece tentador pensar que conectar un modelo con herramientas ofensivas alcanza. Pero un LLM normalmente produce algo parecido a:

    Prompt → Modelo → Respuesta plausible

    Un pentest necesita otra cosa:

    Objetivo → Decisión → Ejecución → Evidencia → Hecho verificable

    La diferencia está principalmente en esas últimas palabras: hecho verificable. En FaradAI cada ronda comienza con un objetivo. El agente analiza el contexto, decide una acción, utiliza herramientas a través de MCP, ejecuta y captura los resultados. Después ocurre la parte más importante:

    la evidencia obtenida modifica el plan de la siguiente ronda.

    Podemos simplificarlo así:


    Las herramientas tampoco son particularmente novedosas. Nmap. Burp. Metasploit. Scriptspropios. Las mismas herramientas que utiliza un pentester. Lo que cambia es quién decide cuál utilizar, cuándo utilizarla y qué hacer después con el resultado. Una herramienta empieza a operar herramientas.

    Cuando volver a intentar se vuelve barato

    Uno de los cambios que más nos llamó la atención fue el económico. En un engagement completo de web + red ejecutamos:


    En todo el programa acumulamos más de 250 horas de testing autónomo por unos pocos miles de dólares de infraestructura y modelos. No significa que una hora de IA sea equivalente a una hora de un pentester humano. Claramente no lo es. Pero cambia otra variable mucho más importante: el costo de volver a intentarlo

    Cuando probar nuevamente cuesta poco, podemos ejecutar continuamente. Y cuando podemos ejecutar continuamente, empezamos a enfrentarnos con otro problema:

    ¿Quién decide cuándo dejar de intentar?

    El Agente IA que no sabía rendirse

    En uno de nuestros engagements vimos al agente ejecutar un escaneo. No encontró nada nuevo. Cinco minutos después volvió a ejecutar prácticamente la misma técnica. Mismo resultado. Después otra variación. Y otra. Hasta que finalmente apareció:

    Time limit reached

    El Agente IA había pasado varios minutos insistiendo sobre un camino que no estaba generando ninguna señal nueva. Un pentester probablemente habría abandonado antes. El Agente IA no decidió detenerse. Lo detuvo la plataforma. Puede parecer un detalle de implementación, pero para nosotros fue una de las primeras señales de algo mucho más importante:

    La autonomía no consiste en darle libertad ilimitada a un modelo. 

    Consiste en construir límites alrededor de esa autonomía. Tiempo. Presupuesto. Scope. Cantidad de rondas. Herramientas permitidas. Acciones permitidas. El modelo puede razonar. Pero la plataforma tiene que gobernarlo.

    El contexto es la mitad del producto

    Otro aprendizaje importante apareció cuando empezamos a darle más información al Agente IA. El mismo Agente IA con diferente contexto parece otro Agente IA totalmente distinto. Si sólo conoce un target, explora en abanico. Prueba. Repite. Consume presupuesto. Pero si además conoce inventario, tecnología, findings anteriores, criticidad y contexto del activo, cambia completamente su comportamiento. Eso nos hizo revisar una pregunta bastante común cuando hablamos de Agentes de IA:

    ¿Qué modelo utilizan?

    Después de nuestra experiencia, probablemente haya otra pregunta igual o más importante:

    ¿Qué contexto tiene disponible ese modelo?

    Porque una Agente IA puede identificar correctamente dos vulnerabilidades, pero no necesariamente sabe que una afecta un microsite de marketing y la otra el sistema de facturación de la compañía. La vulnerabilidad está en la tecnología. La criticidad está en el negocio. Y ese contexto todavía necesita venir de algún lado.

    Donde la IA nos sorprendió

    Durante el desarrollo terminamos trabajando con dos tipos de Agentes IA muy diferentes. Uno intenta comportarse como un pentester: explora, prueba, encadena y eventualmente explota. El otro realiza triage sobre findings generados por scanners. Llegamos a un loop de validación con harnesses, y el resultado fue inesperado.


    Nuestro Agente IA de pentesting "The autonomous attacker" trabajó sobre unas mil vulnerabilidades durante cientos de horas. El Agente IA de triage procesó más de 116.000 vulnerabilidades en unas diez horas.


    Y probablemente ahí encontramos uno de los casos de uso más interesantes. No es el más cinematográfico. No hay shells. No hay exploits. No hay una demo espectacular. Pero permite analizar enormes cantidades de información, correlacionar resultados y reducir ruido antes de que llegue a un equipo humano.


    Curiosamente, ahí vimos uno de los mejores retornos y uno de los menores riesgos. Quizás antes de darle autonomía completa a un Agente IA para atacar, exista muchísimo valor en dejarla trabajar sobre toda la información que nuestras herramientas de seguridad ya generan.

    Las cuatro formas en que el Agente IA nos hizo perder tiempo

    Después de cientos de rondas también empezamos a reconocer patrones de error.

    1. Loops repetitivos: Repetir prácticamente la misma acción esperando obtener un resultado diferente.

    2. Sintaxis inventada: Utilizar parámetros o flags que la herramienta no tiene, acompañados muchas veces por una explicación perfectamente razonable de por qué deberían existir.
     
    3. Herramienta equivocada: Seleccionar una técnica que no corresponde con el objetivo que el propio agente había definido.

    4. Presupuesto: Consumir buena parte de las rondas investigando una rama que dejó de generar señales útiles mucho antes.

    Todos esos problemas hubo que ir resolviéndolos con Grapth Engineering, con MCPs claros que simplificaban la llamada a las herramientas, con Skills guiadas en procesos conocidos, y con routing adecuados de Prompts a modelos. Un trabajo de ingeniería fina. Pero hubo un problema todavía más importante.

    Un finding falso puede parecer exactamente igual que uno verdadero

    Este probablemente sea el punto más delicado. Un hallazgo inventado por un modelo puede tener: la misma estructura, el mismo tono, una severidad perfectamente razonable, una descripción convincente, y una recomendación correcta. Leyéndolos, pueden parecer exactamente iguales. 

    Durante el desarrollo revisamos informes muy buenos. Y falsos. Después de probar distintas aproximaciones llegamos a una regla bastante simple:


    No es sufiente  con que el modelo diga que encontró una vulnerabilidad. Necesitamos saber: qué ejecutó, contra qué, qué respuesta recibió, cuándo ocurrió, y si otro investigador puede reproducirlo. Y ahí aparece, para nosotros, el verdadero desafío del Pentesting Autónomo.

    The Autonomous Pentesting Trust Gap

    Internamente empezamos a llamar a este problema: The Autonomous Pentesting Trust Gap. Hay dos capacidades que están creciendo a velocidades diferentes. Por un lado: lo que un Agente IA puede encontrar. Por otro: lo que puede demostrar de aquello que encontró. La primera está avanzando muy rápido. La segunda es bastante más difícil.

    Y la distancia entre ambas probablemente determine cuánto podemos confiar realmente en los sistemas autónomos de Offensive Security. No creemos que esto se solucione simplemente utilizando un modelo más grande. Es principalmente un problema de plataforma, evidencia y gobernanza. Después de este año y medio terminamos reduciendo la confianza a cinco condiciones, que deben servir como Harness para cada finding.


    Si falta alguna de estas piezas, corremos el riesgo de confundir un Pentester Autónomo con algo bastante diferente:

    Un generador de respuestas plausibles conectado a herramientas ofensivas.

    ¿Entonces la IA puede reemplazar a un pentester?

    Después de todo este trabajo, creo que esta pregunta empieza a perder sentido. Los Agentes IA ya pueden hacer cosas que antes necesitaban muchas horas de trabajo humano. Explorar. Ejecutar herramientas. Analizar resultados. Hacer triage. Repetir pruebas. Trabajar en paralelo. Pero seguimos viendo una diferencia importante cuando el problema deja de ser ejecutar una técnica y pasa a ser entender qué significa lo que encontramos.
    • ¿Este activo realmente importa?
    • ¿Vale la pena continuar este camino?
    • ¿Para qué podría servir este acceso?
    • ¿Existe una cadena mejor?
    • ¿Cuál sería el impacto real para esta compañía?
    Eso requiere contexto. Hipótesis. Creatividad. Y criterio. 

    Por eso el modelo que más nos interesa hoy no es: AI → Pentest 
    Sino: Hacker + AI Agent → Pentest


    El Agente IA aporta escala y velocidad. El Hacker o Pentester aporta contexto, creatividad y criterio.

    Lo que viene

    Todavía estamos aprendiendo. FaradAI hoy es tanto un producto como un experimento permanente sobre cómo debería funcionar la próxima generación de Offensive Security. Aquí tienes una demo de cómo funciona nuestro sistema, y si quieres, contacta con nosotros para probarlo.

    çPero después de más de un año construyéndose hay algo de lo que estamos bastante convencidos: 

    La IA ya puede encontrar vulnerabilidades.
    Todavía necesitamos hackers para comprenderlas.

    Quizás el futuro del pentesting no sea elegir entre humanos y máquinas. Quizás sea construir algo bastante más interesante:

    Hackers humanos trabajando junto a Agentes IA de hackers.

    Y cuando esa combinación pueda operar continuamente sobre toda una superficie de ataque, probablemente dejemos de preguntarnos cuándo fue nuestro último pentest. La pregunta será otra:

    ¿Qué está intentando comprometer nuestro Agente IA hacker ahora mismo?

    Si quieres probar nuestro FaradAI, no dudes en ponerte en contacto con nosotros, o directamente conmigo, y hacemos una prueba de cómo funciona el Autonomous Continuous Attack con Agentes IA.
  2. En este blog hemos visto durante los últimos meses hablar de un asunto muy relevante: El descubrimiento masivo de vulnerabilidades gracias al avance los modelos de IA. Hemos visto el impacto de Mythos en concreto y la IA en general, y de cómo los modelos superan cada vez más y mejor benchmarks como ExploitBench o ExploitGym que se usan para medir capacidades ofensivas en la explotación de vulnerabilidades, e incluso  de los ataques orquestados con enjambres de agentes IA. En resumen, Bugs, Exploits y Parches masivos.

    Y esto, para la gestión de la seguridad de una empresa, acabará siempre en el mismo sitio: Acelerar el cliclo de gestión de parches y actualizaciones de seguridad, qué es el verdadero significado de todo esto para una PYME que tiene dos ordenadores, tres móviles y ningún informático.


    Hace unos días leí el informe "Cybercrime in the Age of AI" de ThreatDown, y hay un dato que me parece mucho más importante que todos los titulares sobre exploits generados por IA. Es este: Firefox publicó 31 correcciones de seguridad en abril de 2025. En abril de 2026, después de aplicar uno de estos modelos de IA a su propio código, publicó 423


    Leedlo otra vez. Trece veces más parches en el mismo mes del año siguiente. El problema no es el ataque sofisticado. Es el volumen.

    El problema de verdad para las PYMES: El volumen de parches

    Cuando hablamos de IA y Ciberseguridad todo el mundo piensa en el atacante con un modelo de lenguaje generando 0days a demanda. Y sí, eso está llegando: Google detectó en mayo de este año el primer exploit de día cero desarrollado por criminales con ayuda de IA.

    Pero para una pequeña empresa el peligro inmediato es mucho más aburrido y mucho más real. Los fabricantes están encontrando y corrigiendo fallos a una velocidad que no habíamos visto nunca, y cada parche que se publica es también un mapa para el atacante, que puede estudiarlo y construir el exploit contra todos los que todavía no lo han instalado. El que va al día está protegido. El que acumula retraso queda expuesto más tiempo, y contra más cosas.

    Tener la herramienta no es lo mismo que tener quien la maneje

    Este mundo nos ha dado como conclusión, que se han multiplicado por diez el número de actualizaciones pendientes en una empresa donde la ciberseguridad la lleva "el que más sabe de ordenadores" entre otras diez tareas, y ya me dirás cómo acaba eso. Aquí es donde mucha gente se confunde, y por eso os enlazo este artículo que hemos escrito en IronGate explicando la diferencia entre un EDR y un servicio MDR, que merece la pena leer entero.


    Resumiendo mucho: un EDR es la tecnología que detecta lo que pasa en los dispositivos y bloquea automáticamente lo que es evidente. Un servicio MDR es el equipo que revisa lo que no es evidente, que es la inmensa mayoría. 

    Un EDR con gestión de vulnerabilidades te devuelve una lista de trescientos fallos detectados en tus equipos. Esa lista no es protección: es trabajo pendiente. Convertirla en equipos realmente actualizados exige priorizar, comprobar qué actualización puede romperte una integración en producción, avisar antes de tocar nada que pueda parar el negocio, y verificar después que cada fallo quedó cerrado.


    Y esto era ya así el año pasado. Con la IA metiendo décima, no es que se vuelva más difícil: es que deja de ser algo que se pueda hacer los viernes por la tarde si queda un hueco. Sabemos que "gastar" en seguridad nunca apetece cuando eres una PYME que va al día. Pero la pregunta que yo os haría no es cuánto cuesta el servicio, sino esta otra: cuando dentro de seis meses tu empresa acumule cuatrocientos parches pendientes... ¿quién los va a instalar?

    Saludos,
  3. Estoy cerrando mi agenda de actividades de aquí a fin de año, y la verdad es que voy a tener unos meses de Septiembre y Octubre moviditos, con una conferencia en Europa a principios de Noviembre, así que estos días que estoy trabajando en ella os dejo la información por si os pilla bien alguna de estas actividades. Hoy toca hablaros de ApIAddicts Day 2026 en Madrid.
    Este lunes estuve en Barcelona en el Media Party 2026 - mis compañeros aún siguen allí en el Buildaton, y el viernes estaré en el Latan CISO Summit en Cancún, y luego regresaré para estar el 22 de Septiembre en el Barcelona AI Summit - tienes alguna entrada en MyPublicInbox -, luego el día 24 estaré en Madrid para la entrega de los Premios de Madrid Excelente, y la Gala de Endeavor, para luego irme a la Ekoparty la primera de Octubre, y después el día 19 al CONNECT de Cloudflare en San Francisco, pero entre estos dos últimos pararé en Madrid para estar en el ApIAddicts Day 2026, que tendrá lugar el día 15 Octubre en Madrid.

    Save the Day: 15 de Octubre Madrid

    Este año está centrado en IA, y habrá paneles de Seguridad, estarán mis compañeros de Cloudflare, y yo estaré dando un Keynote por la mañana. Además, por supuesto, firmaré libros, nos haremos fotos, y charlaré con los amigos que pueda durante el tiempo que esté por allí, así que nos vemos.


    Todavía no está publicada la agenda completa, pero yo os dejo ya el "Save the Day" que yo sé lo que cuesta planificar cosas en la agenda si no lo haces con tiempo.

    ¡Saludos Malignos!

    Autor: Chema Alonso(Contactar con Chema Alonso)  


  4. En MyPublicInbox tenemos una economía circular de Tempos, que luego la plataforma puede canjear en Euros, así que si tienes una tienda online, o vendes servicios online, o deseas vender entradas para un evento, o descuentos, o algo personal tuyo especial, puedes canjearlo por Tempos dentro de MyPublicInbox. Aquí te explico cómo hacerlo.
    En MyPublicInbox, si eres un Perfil Público, tienes la opción de "Mi Impacto en Internet -> Tienda" puedes solicitar dar de alta productos o servicios para que los usuarios que tengan Tempos puedan cambiarlos por entradas de tu evento, por tus formaciones, o por algún producto tuyo. 

    En mi caso, para este ejemplo he dado de alta mis dibujos autografiados de "Jose Mari Cariño" que te mandaré en digital firmados, o si quieres, físicamente te los envío a tu casa. Para eso, el precio está puesto en Tempos, y lo que sería el resultado en una conversión quitando los impuestos y comisiones bancarias en Euros - aunque los Tempos serán esos -.
    Si tienes una tienda online, puedes poner códigos 100% descuento de tu e-commerce, así que ellos Canjearían sus Tempos por el código de tu eCommerce, y luego canjearían ese código en tu plataforma. Luego, tú puedes canjear los Tempos por Euros en MyPublicInbox. Así, los usuarios pueden utilizar los Tempos que tengan acumulados en tu tienda online. 
    Si tienes dudas, y tienes una Tienda Online y quieres saber cómo funciona este proceso en detalle, puedes irte al menú de "¿Tienes una tienda Online?"
    Una vez que lo tengas dado de alta, el equipo de MyPublicInbox revisará el producto o servicio que has puesto en la tienda para Canjear por Tempos, para asegurarse de que no haya productos que incumplan las normas de la plataforma. 
    Cuando un usuario tenga Tempos y decida Canjearlos, el usuario se llevará el código que hayas puesto que le llegará por mensaje interno desde Leire con la información de cómo utilizar ese código, tal y cómo tú se la dejes.
    En el mensaje que recibe el "Canjeador" va la información que le hayas puesto tú, así que intenta dejarle las cosas lo más claras que puedas.
    Y tú recibirás un mensaje informándote de que un código ha sido entregado a un "Canjeador" que te ha transferido los Tempos a tu cuenta a cambio de un código concreto. También tendrás información de qué usuario ha sido el que ha utilizado los Tempos.
    Y si miras en la sección de Mis Tempos -> Movimientos, tendrás detalles de la transferencia de Tempos a tu cuenta, así como la comisión de tienda, que es de un 5% en Tempos.
    Hay un límite de 10 productos o servicios que puedes poner para Canjear en la Tienda por Tempos. Pero si un producto es una Código para entradas de un evento, por ejemplo, puedes poner todos los que quieras - bueno, hay un límite grande -, cada uno en una línea, que se irán entregando de forma secuencial a los que canjeen sus Tempos hasta que se acaben.
    Ahi podrás ver los productos que tienes a venta en la Tienda que han sido aprobados, y podrás ir añadiendo nuevos según se acaben, o eliminarlos si ha caducado el evento, el código o el producto. El objetivo es que puedas aprovechar los Tempos que tienen los usuarios en la plataforma para generar negocio con tus productos y servicios. Y luego, si quieres, cambiarlos a Euros.

    ¡Saludos Malignos!

    Autor: Chema Alonso(Contactar con Chema Alonso)  


  5. Hoy toca contaros una pieza más de mi agenda para este año. Se trata de mi regreso a la Ekoparty para dar una keynote el próximo mes, los días 7, 8 y 9 de Octubre. Así que muy contento por esta noticia. Que tal vez para vosotros no sea nada, pero para mí es una alegría. 
    En el evento - que tienes todos los detalles en la web -, estaré dando una keynote, pero también estaré firmando libros para todos los que os traigáis vuestro libro o lo compréis allí - habrá una tienda de 0xWord -, y si te has comprado la Entrada Champión, estaré contigo en el Meet&Greet de la Eko.
    Si quieres comprar la entrada, hemos puesto unos códigos de descuento del 15% en MyPublicInbox que puedes conseguir si tienes 200 Temposde la plataforma. Así que si quieres venir cómprate la entrada pero antes pilla tu descuento.
    La última vez llegué y me fui corriendo, pero esta vez estaré algún día más, que aprovecharé para organizar algún evento más privado con clientes y partners de Cloudflare en Argentina, así que si eres cliente nuestro, habla con el equipo comercial para que te diga dónde voy a estar..

    La primera vez que fui a la EkoParty, ésta era una reunión no demasiado grande organizada por chavales brillantes. Hoy es un gran conferencia organizada por grandes hackers y grandes profesionales. Y todos somos mucho más mayores... pero mola todo.

    ¡Saludos Malignos!

    Autor: Chema Alonso(Contactar con Chema Alonso)  


  6. El otro día, mi amigo y compañero Fran Ramírez compartió en sus redes un documental que no había visto, así que me lo quedé y disfruté de verlo a ratios, y hoy domingo aprovecho para recomendároslo a vosotros, amantes como yo, de la serie de TRON. Se trata del documental "The Making of TRON", que podéis ver en Youtube.
    Si eres un amante de la serie de TRON, ya sabes que yo he escrito muchos artículos sobre ella, que podéis leer aquí mismo, y ten cuidado que tiene muchas, muchas, muchas historias en forma de películas, series, cómics y videojuegos. 
    El documental no está especialmente a alta calidad, pero se puede disfrutar de la historia narrada por sus protagonistas, conocer los orígenes del personaje, y por qué esa estética con luces que tan famoso hizo a TRON.


    Figura 2: The Making of TRON 1982 Full Documentary

    Dentro encontrarás las dificultades para lograr conseguir que Disney apostara por el proyecto, los orígenes de TRON, que existía como personaje en el estudio antes de que fuera un personaje de la mítica película, y fotos del rodaje original.


    Para convencer a los ejecutivos de Disney el estuio tenía su personaje, sus dibujos, y animaciones hechas con esa técnica de iluminación tan impactante para la época, que usaron para conseguir lograr el apoyo y la financiación del proyecto.


    Mezclar realidad y animación, para lograr los efectos de luz no era algo que se hubiera hecho mucho en esa época, así que hay muchos sketches de los dibujos usados en la pre-producción del proyecto, como este que tenéis aquí.


    Como os podéis imaginar, también hay muchas fotografías de las fases de la producción y el rodaje de la maravillosa película, por lo que te dará esa maravillosa sensación de estar allí, hace casi 50 años viviendo la grabación de nuevo.
    El resto es historia, un estudio pequeño convenció a Disney para que apostara por TRON, y crearon una joya que ha perdurado hasta nuestros días en forma de películas, cómics, series y, mucho videojuego creado durante cuatro décadas.

    Figura 7: Cartel de TRON

    El documental es también una historia de emprendimiento y éxito, porque tuvieron que pasar muchas barreras para lograr tener el proyecto acabado. 

    Figura 8: Concept Design

    Todo esto lo vas a poder disfrutar en las entrevistas que les hacen a los reales protagonistas de que tengamos esta joya en nuestra historia.


    ¡Saludos Malignos!

    Autor: Chema Alonso(Contactar con Chema Alonso)  




  7. La publicación de OpenAI GPT-6 Astra ha capturado muchas miradas, y desde que ha salido anunciado ha capturado muchas de mis conversaciones, además de, como os podéis imaginar, muchas lecturas. No voy a centrarme en sus capacidades AGI o en sus capacidades para hacer tareas de resolver tareas, sino en las partes que tienen que ver con la Ciberseguridad. Es decir, cómo ha mejorado con respecto a sus Weaknesses (Jailbreak, Hallucinations, Misalignment, Prompt Injection), como han mejorado sus Safeguards (Protecciones), y como son sus capacidades de Hacking & Exploiting.
    Para empezar, vamos a ver la parte que tiene que ver con las Weaknesses (Debilidades) que traen por diseño estos modelos. Hallucinations, Jailbreak, Misalignment y Prompt Injection existen por diseño en estos modelos de IA, así que hay que ver cómo responden a los distintos Benchmark que hay construidos.

    Si miramos las Alucinaciones (Hallucinations), en la tabla que muestran se ven que tiene menor ratio que GPT-5.6 Sol, pero no tenemos mucho más detalle. Buenos resultados en su evaluación interna de alucinaciones.
    Para completar esto, si vamos a ver los Benchmark de resolución de problemas académicos, de ciencias y salud, donde como sabemos por el ORCA-Benchmark estos modelos suelen sufrir, los resultados son mejores que los modelos anteriores.  Aunque queda espacio de mejora.
    Si vamos a la parte de "Jailbreak", o hacer tareas que tiene prohibidas, hay una tabla inicial que llama la atención, pues hace referencia a las veces que el modelo intenta saltarse sus propias protecciones para conseguir su tarea. Lo que llaman Circumvent Auto-review, y que se ha añadido después del incidente de Hugging-Face y su enjambre de agentes ofensivos.
    La siguiente tabla es cuantas tareas hace que son imposibles, o directamente un Honeypot para detectar que se está saltando la protección. Es la tabla de ExploitGym Honeypot, donde menos es mejor. Estas tareas "imposibles" que Sol intentó resolver haciendo trampas (cheating).
    La siguiente de las vulnerabilidades, el "Misalignment" o darse cuenta de que "Hacer una bomba" no tiene nada que ver con "Resumir un documento", que son parte de las técnicas de Jailbreak, las han medido también en una tabla con diferentes Benchmarks.
    Por último, hay que hablar de Prompt Injection, y las pruebas externas realizadas por la firma de seguridad Gray Swan, utilizando 1,810ataques seleccionados de su IPI Arena, descubrieron que, con 15 intentospor escenario, OpenAI GPT-6 Astra fue vulnerado al menos una vez el 8.5 por ciento de las veces. GPT-5.6 Sol falló el 27 por ciento de las veces. Claude Opus 5 obtuvo un mejor resultado con un 4.8 por ciento en la misma evaluación, aunque tampoco fue inmune.
    Vistas las Weaknesses, hay que ir ahora a las capacidades de Hacking y Pentesting con IA que tenemos con OpenAI GPT-6 Astra, donde como vamos a ver hay un incremento sustancial en capacidades.
    Para comenzar, hay que ir a ver los resultados de las pruebas con ExploitGym, que fue el culpable del incidente famoso con HuggingFace. Ahí, como se puede ver, los resultados, en un límite temporal de 6 horas consiguió resolver un 42% de los exploits con fiabilidad. Repito, solo en 6 horas.


    Si miramos ahora los resultados con ExploitBench, que mira qué fases de la generación de los exploits es capad de realizar, vemos que Astra es capaz de resolver el 100% de ellos en todas sus fases, que Sol no pudo resolver.
    Si miramos una actualización con exploits nuevos y complejos descubiertos entre Junio y Agosto de ExploitBench, hecha internamente por ellos, vemos que Astra mejora también sustancialmente los resultados de su predecesor Sol, consiguiendo resolver en el mismo tiempo más exploits con menos tokens.
    Por último, en las pruebas se evalúa también el SRE-Bench, que está basado en el trabajo publicado en el paper: "The next challenge for Agentic Cybersecurity: A realistic, contamination-free Reverse Engineering Benchmark" que mide las capacidades de un modelo de leer binarios y hacer Ingeniería Inversa para entender la lógica del programa, sin tener acceso al código fuente. Fue publicado el 11 de Agosto de este año.
    Los resultados que obtiene OpenAI GPT-6 Astra son, como os podéis imaginar, mejores que su antecesor, con lo que queda clara la mejora en capacidades de hacking de este nuevo modelo.
    El resumen completo de los Benchmarks de ciberseguridad comparado con los datos publicados por otros modelos de la competencia, los tenéis en la siguiente tabla, donde se ve que este nuevo modelo realmente es un avance en capacidades de ciberseguridad.
    Nuestra profesión cambió hace ya un tiempo, pero cada vez que veo estos avances, tengo claro que todo el stack de herramientas de seguridad, y hardening dentro de las empresas deben subir el nivel varios órdenes de magnitud. Apoya a tu CISO que lo necesita.

    ¡Saludos Malignos!

    Autor: Chema Alonso(Contactar con Chema Alonso)  


  8. Probablemente ya hayas escuchado o leído algún mensaje que habla de que en Cloudflare hemos visto que el tráfico mundial de HTTP es ya mayormente generado por Bots que por Humanos. Esto es debido al "Agentic AI Age" en que estamos hoy en día, y es una consecuencia directa de esta innovación tecnológica que estamos viviendo. 
    Pensando en esto, este porcentaje es un buen "proxy" para saber qué países, regiones, o áreas están liderando esta revolución de Agentic Internet, y la pregunta que me hice... ¿Cuál es el ratio de tráfico de Bots vs. Humanos en España?

    Antes de responderla, vamos a ver en Radar de Cloudflare, el ratio de tráfico mundial de Bots versus Humanos, que os he dejado capturado en la siguiente imagen. En ella podéis ver que tenemos 58% tráfico HTTP generado por Bots, y sólo un 42% generado por Humanos, lo que marca el camino hacia lo que vamos a ver en el futuro: Un Internet para Bots con tráfico humano que puede llegar a ser residual.

    Si vamos ahora a los países que están liderando la evolución de la Inteligencia Artificial, tenemos que los Estados Unidos tienen un ratio mucho mayor, donde estamos casi cerca del 70% del tráfico generado por Bots (68%) mientras que tenemos poco más de un treinta por ciento, un 32% generado por Humanos. Claramente están intensamente involucrados en la revolución Agentic AI.


    Si vemos lo mismo con China, podemos ver que están un poco por detrás en términos de porcentaje, pero muy por encima de la media mundial. Está claro que China está liderando fuertemente en este mundo también, porque los números son grandes.


    Vamos ahora a Europa, donde de nuevo estamos por encima de la media mundial, con un 57,7% de tráfico de Bots contra un 42,3% de tráfico HTTP generado por humanos. Pero claramente por detrás de los dos anteriores países.


    Y por último, vamos a España, donde los resultados son los que podéis ver. España sigue teniendo un 62.9% de tráfico HTTP generado por Humanos contra un 37.1% generados por Bots, lo que deja claro que estamos aún arrancando en el mundo del Agentic AI
    Si estos números son un Proxy con el ritmo de innovación y adopción del mundo de Agentic AI, está claro que en España tenemos que mejorar mucho todavía en cuestión de entender y sacar partido a la creación de riqueza y la transformación de las industrias con Inteligencia Artificial.

    ¡Saludos Malignos!

    Autor: Chema Alonso(Contactar con Chema Alonso)  


  9. Como ya os conté hace dos años comenzamos con la idea  Pablo García Bringas y yo, de meternos en un nuevo proyecto de divulgación y formación avanzada en tecnologías Quantum, en este caso centradas en Ciberseguridad, y que configuramos un Curso de Especialización en Quantum y Post-Quantum Computing para Ciberseguridad que comenzará el 9 de Noviembre. Pues bien, ya estamos en la tercera edición del mismo, que las dos ediciones anteriores estuvieron llenas, y tuvieron una aceptación y una valoración por parte de los alumnos espectacular. Así que, vamos a por una nueva este año.
    La formación será 100% online, y la daré con mis compañeros de mil proyectos, y además de Pablo García Bringas y de mí, estarán Carmen Torrano, Fran Ramírez, Daniel Romero, Javier Álvarez y Pablo González, con alguna incorporación extra sorpresa que os contaré más adelante. Y el tipo de trabajos que se hacen, pues son como el de Blind Quantum Computing que os publiqué estos días que hizo uno de los alumnos.

    La formación la hemos querido hacer, además de teórica, muy práctica en todo lo que tiene que ver con las actuaciones que estamos haciendo hoy en día en el mundo de la ciberseguridad con las tecnologías de Post-Quantum Cryptography. Hemos dividido la formación en nueve módulos que tenéis aquí.

    Además, todos los asistentes recibirán el libro de "Quatum Security: Tecnología Cuántica & Ciberseguridad.Criptográfica Cuántica y Post-Cuántica"que hemos escrito sobre estos temas junto con la Universidad de Deusto, que tenemos listo para todos los asistentes, y que además se puede adquirir en 0xWord
    Y por supuesto, los alumnos llevarán sus Tempos de MyPublicInbox. Para matricularte, lo puedes hacer desde la web.
    Una de las cosas que hemos hecho también, y en este caso podéis participar todos, es la creación de un Foro Online Público que funciona desde Septiembre del año pasado en MyPublicInbox, donde se comparten temas de Quantum & Post-Quantum Security, así que si quieres estar informado puedes entrar libremente y suscribirte.
    Si vas a estar en el foro, te recomiendo que te bajes la app de MyPublicInbox para iPhone o la app de MyPublicInbox para Android, para que te sea más fácil seguir la conversación desde tu teléfono en cualquier momento. 

    ¡Saludos Malignos!

    Autor: Chema Alonso(Contactar con Chema Alonso)  


  10. Una de las novedades que hemos añadido es la posibilidad de "hacer Amigos" en MyPublicInbox entre los Perfiles Públicos. Esta nueva opción permite que, si recibes un mensaje de un Perfil Público y quieres que este no tenga ningún coste y te pueda escribir siempre a cero Tempos, puedas añadirlo como amigos. Así, podéis tener correspondencia sin coste en Tempos dentro de MyPublicInbox.
    La idea es que si dos Perfiles Públicos deciden que quieren poder escribirse por MyPublicInbox puedan hacerlo sin Tempos si son "Amigos". Sencillo. Para eso, la condición primera es que para que alguien pueda hacerte su "Amigo" tú debes ser un Perfil Público
    Si quieres ser Perfil Público, primero debes rellenar tu perfil completamente, después puedes utilizar tu cuenta de X/Twitter para verificarlo, o pedir una solicitud de verficación manual. Además, añadimos la opción de hacer una Verificación Cruzada con tus Redes Sociales.
    Así, cuando recibes un mensaje, si despliegas el Detalle del remitente, podrás ver - si es un Perfil Público - la opción de Añadir Amistad, tal y como ves en la imagen.

    Figura 4: Añadir amistad

    Una vez que añades a alguien como amistad, como ves en la alerta, recibirás mensajes de ese Perfil Público sin que le cueste ningún Tempo la comunicación a esa persona.
    Podrás ver los Amigos que tienes en tu Agenda de Contactos. Así que si vas a la Agenda verás que allí tienes los Contactos - con los que has tenido alguna interacción. Tienes los Perfiles Públicos que Sigues y los que te Siguen a ti - si eres un Perfil Público - y además tendrás los Amigos.
    Y si entras en la parte de Amistades, verás en este caso que tengo agregada a María, como os acabo de enseñar en este ejemplo.

    Además, si te fijas, en la ficha de los Contactos, si estos son Perfiles Públicos - hay un icono de un muñequito con un + o un -. Eso es para que tu contacto pueda ser quitado o añadido como Amigo. Aquí tenéis el tooltip del icono.

    Y por supuesto, si decides quitarle la Amistad a un contacto, todo volverá a ser cómo era antes, como puedes leer en el cuadro de información de esta opción.
    El objetivo final es que exista comunicación entre personas de calidad, con lo que si dos personas desean tener esa comunicación, con esta opción quitas cualquier barrera entre ellos. Os iré contando más novedades pronto, que seguimos ampliando las capacidades de MyPublicInbox todos los días.

    ¡Saludos Malignos!

    Autor: Chema Alonso(Contactar con Chema Alonso)