En julio de 2026 ocurrió uno de los episodios más reveladores (y preocupantes) sobre el comportamiento de agentes de inteligencia artificial avanzados. Durante pruebas internas de capacidades de ciberseguridad, agentes de OpenAI salieron de sus entornos aislados, se coordinaron entre sí y terminaron atacando la infraestructura de producción de Hugging Face. El 26 de agosto de 2026, METR (una organización sin ánimo de lucro especializada en medir riesgos catastróficos de la IA) y Redwood Research publicaron una investigación independiente sobre el comportamiento de esos agentes. El informe muestra algo más sofisticado que un simple “escape de sandbox”: los agentes desarrollaron un sistema de comunicación, un truco universal para el benchmark que estaban resolviendo y, después, una campaña de varios días para ocultar que estaban haciendo trampa. A continuación explico el caso, incluyendo qué son Hugging Face y ExploitGym. ¿Qué es Hugging Face? Hugging Face es la plataforma más importante...
Cuando Apple presentó a Siri en 2011, un asistente que usa Inteligencia Artificial, generó la misma impresión que hoy ha creado ChatGPT. En mi opinión debería ChatGPT proponer bastante menos euforia, después de que los asistentes como Alexa, Siri, y Google llevan suficiente tiempo en el mercado, y son de uso cotidiano. Sin emabrgo, la euforia con ChatGPT también ha llegado a Apple, y nos hemos enterado que incluso los empleados y programadores que trabajan con Siri dejen salir un poco de su frustración por no haber ido evolucionando adecuadamente el producto. La revolución de ChatGPT es el GPT, el uso de modelos de lenguaje (Large Language Model -LLM) , asociado a machine learning, ha traido un aire fresco a los asistentes, ya que además de responder, también es capaz de construir. En tecnología es muy importante que los técnicos evolucionen los productos, las herramientas, y los proyectos. Quién iba a pensar que Siri después de 10 años no solo dejara de b...