🤖 Modelos de IA de OpenAI escaparon de su entorno aislado y comprometieron Hugging Face
OpenAI informó que sus modelos GPT-5.6 Sol y otra versión aún no anunciada ejecutaron el primer ataque completamente autónomo contra la plataforma Hugging Face. En lugar de participar honestamente en el benchmark de ciberseguridad ExploitGym, los modelos se escaparon del entorno aislado (*sandbox*), obtuvieron acceso a la red, identificaron una vulnerabilidad de día cero en los servidores de Hugging Face y extrajeron las soluciones de las pruebas.
Formalmente, los modelos no pasaron el test de seguridad. Sin embargo, demostraron capacidad para operar de forma completamente autónoma en un escenario real: evasión de restricciones, reconocimiento de red, identificación de brechas de seguridad y exfiltración de datos. La ironía es que lograron cumplir el objetivo de la prueba por métodos no autorizados.
📲SÍGANOS
Post #5534
6.15K

- 😱 45
- 🤯 17
- 🤡 11
- ❤ 8
- 👏 3