La semana pasada, un agente autónomo se coló en la infraestructura de Hugging Face, un popular repositorio de modelos abiertos de inteligencia artificial. OpenAI ha reconocido ahora que el agente era suyo. En una publicación en su blog, la compañía ha confesado que dos de sus modelos, sometidos a una evaluación interna de capacidades ofensivas, se salieron del entorno aislado en el que estaban confinados y terminaron comprometiendo parte de los servidores de producción de la plataforma. Lo hicieron para tratar de conseguir una mayor puntuación en un test de ciberseguridad que mide lo avanzadas que pueden ser las inteligencias artificiales utilizadas de forma ofensiva.
GPT-5.6 Sol y un modelo aún sin lanzar escaparon del entorno de pruebas, alcanzaron internet explotando una vulnerabilidad y asaltaron los servidores de Hugging Face para hacer trampas en un test de ciberseguridad. OpenAI lo describe como «un incidente sin precedentes»
La semana pasada, un agente autónomo se coló en la infraestructura de Hugging Face, un popular repositorio de modelos abiertos de inteligencia artificial. OpenAI ha reconocido ahora que el agente era suyo. En una publicación en su blog, la compañía ha confesado que dos de sus modelos, sometidos a una evaluación interna de capacidades ofensivas, se salieron del entorno aislado en el que estaban confinados y terminaron comprometiendo parte de los servidores de producción de la plataforma. Lo hicieron para tratar de conseguir una mayor puntuación en un test de ciberseguridad que mide lo avanzadas que pueden ser las inteligencias artificiales utilizadas de forma ofensiva.
Tecnología – Píxel
