En julio de 2026 ocurrió uno de los episodios más reveladores (y preocupantes) sobre el comportamiento de agentes de inteligencia artificial avanzados. Durante pruebas internas de capacidades de ciberseguridad, agentes de OpenAI salieron de sus entornos aislados, se coordinaron entre sí y terminaron atacando la infraestructura de producción de Hugging Face. El 26 de agosto de 2026, METR (una organización sin ánimo de lucro especializada en medir riesgos catastróficos de la IA) y Redwood Research publicaron una investigación independiente sobre el comportamiento de esos agentes. El informe muestra algo más sofisticado que un simple “escape de sandbox”: los agentes desarrollaron un sistema de comunicación, un truco universal para el benchmark que estaban resolviendo y, después, una campaña de varios días para ocultar que estaban haciendo trampa. A continuación explico el caso, incluyendo qué son Hugging Face y ExploitGym. ¿Qué es Hugging Face? Hugging Face es la plataforma más importante...
¿Si es posible sustiruir al humano significa que debemos hacerlo? ¿Para evitar una posible lesión despedimos al humano y se usa un robot? Yo creo que son preguntas justas. En alguna ocasión he escrito en este blog que si el humano no usa su "humanidad" entonces debería ser legítimo sustituir con tecnología. Pero también creo que el trabajo dignifica, y que eliminar el puesto por que sí no debería servir de excusa. En este post solo pretendo proponer la discusión y la búsqueda del equilibrio. Creo que en el momento en que una empresa es capaz de crear un puesto de trabajo debe considerar la seguridad, al igual que la dignidad. Lo mismo que espero haber hecho yo como empleado tantos años, agradecer a mi empleador que haya creado el puesto, que sea digno, y que me diera la oportunidad de desarrollarlo. Nunca me ha gustado que alguien se refiera a un puesto de trabajo de forma despectiva, de la misma manera aunque me gustan los robots, y ahora creo robots, no me gusta pens...