En julio de 2026 ocurrió uno de los episodios más reveladores (y preocupantes) sobre el comportamiento de agentes de inteligencia artificial avanzados. Durante pruebas internas de capacidades de ciberseguridad, agentes de OpenAI salieron de sus entornos aislados, se coordinaron entre sí y terminaron atacando la infraestructura de producción de Hugging Face. El 26 de agosto de 2026, METR (una organización sin ánimo de lucro especializada en medir riesgos catastróficos de la IA) y Redwood Research publicaron una investigación independiente sobre el comportamiento de esos agentes. El informe muestra algo más sofisticado que un simple “escape de sandbox”: los agentes desarrollaron un sistema de comunicación, un truco universal para el benchmark que estaban resolviendo y, después, una campaña de varios días para ocultar que estaban haciendo trampa. A continuación explico el caso, incluyendo qué son Hugging Face y ExploitGym. ¿Qué es Hugging Face? Hugging Face es la plataforma más importante...
Viendo un debate en el que participa Felipe González y se trata la brecha digital en Latinoamérica, me ha gustado mucho lo dicho por González en referencia a la "Libertad de Expresión", donde dice que "la libertad de expresión llega hasta donde alcanza los derechos fundamentales de los demás".
En un momento en el que se habla tanto de "libertad de expresión" principalmente en las redes sociales, y parece que es permisiva con todo, creo que una definición básica basado en el tercero es fundamental.

Comentarios
Publicar un comentario