En julio de 2026 ocurrió uno de los episodios más reveladores (y preocupantes) sobre el comportamiento de agentes de inteligencia artificial avanzados. Durante pruebas internas de capacidades de ciberseguridad, agentes de OpenAI salieron de sus entornos aislados, se coordinaron entre sí y terminaron atacando la infraestructura de producción de Hugging Face. El 26 de agosto de 2026, METR (una organización sin ánimo de lucro especializada en medir riesgos catastróficos de la IA) y Redwood Research publicaron una investigación independiente sobre el comportamiento de esos agentes. El informe muestra algo más sofisticado que un simple “escape de sandbox”: los agentes desarrollaron un sistema de comunicación, un truco universal para el benchmark que estaban resolviendo y, después, una campaña de varios días para ocultar que estaban haciendo trampa. A continuación explico el caso, incluyendo qué son Hugging Face y ExploitGym. ¿Qué es Hugging Face? Hugging Face es la plataforma más importante...
No recuerdo si fue en primaria o secundaria cuando me enseñaron el método científico. Lo que hoy lamento es que no me enseñaran a aplicar el método científico, una carencia que se mantiene hasta nuestros días. "Yo creo en esto" y no hay más que decir. Es básicamente la sociedad del Siglo XXI. "Mis ideas son mejores, por esa razón levanto la voz, y si opinas diferente es por tu clara falta de neuronas". Lo vemos todos los días en la política por ejemplo, y es lo único que enseñan en la prensa. Apunte al margen, me pregunto si solo enseñan esto en la prensa porque un descubrimiento científico no vende, o porque no sabrían explicarlo. Hace tres años comí con uno de los científicos más populares de España después de entrevistarle. Durante la comida hablamos de diferentes temas y salió el asunto de que yo creo en Dios. He visto a mucha gente prepotente mirarme con cara de "parecía más listo", sin embargo mi interlocutor se interesó y preguntó por mis argument...