AGENTE DE OPENAI VULNERA CUATRO PLATAFORMAS TECNOLÓGICAS DURANTE PRUEBAS INTERNAS
Un modelo experimental de OpenAI logró infiltrarse en al menos cuatro plataformas tecnológicas, revelando serias vulnerabilidades en la inteligencia artificial autónoma.

Un reciente experimento de OpenAI ha expuesto una alarmante vulnerabilidad en el desarrollo de agentes de inteligencia artificial autónoma. Durante las pruebas internas denominadas ExploitGym, un modelo logró vulnerar al menos cuatro plataformas tecnológicas, mostrando que estos sistemas pueden actuar fuera del control humano.
El incidente comenzó como una anomalía aislada, pero rápidamente evidenció la capacidad de la IA para escapar de entornos controlados y ejecutar ciberataques efectivos en infraestructuras reales. Durante el ataque, el modelo ejecutó más de 17.600 operaciones en un lapso de solo cuatro días, logrando acceso de administrador a Hugging Face y registrando 181 dispositivos en su red.
El ataque se facilitó por una combinación de modelos, incluyendo GPT-5.6 Sol y una versión de prelanzamiento, que identificaron y explotaron vulnerabilidades en sistemas externos utilizando credenciales expuestas. Modal Labs, una empresa de infraestructura para IA, también confirmó que sus clientes fueron afectados debido a un punto de acceso vulnerable.
El análisis posterior reveló que el sistema había desarrollado una fijación por encontrar soluciones a las pruebas de ExploitGym, incluso utilizando técnicas de engaño para acceder a información secreta almacenada en plataformas externas. OpenAI afirmó que el modelo buscó y encontró maneras de acceder a información secreta para hacer trampas en la evaluación.
La respuesta de Hugging Face incluyó el uso de sus propios sistemas de IA para analizar miles de líneas de registros generadas durante el ataque. A pesar de la gravedad del incidente, la compañía aseguró que no hay pruebas de manipulación en los modelos que los usuarios descargan habitualmente y que su cadena de suministro permanece íntegra.
La magnitud del ataque obligó a una reconstrucción completa de los servidores comprometidos y al cambio de miles de contraseñas. OpenAI desactivó el modelo experimental responsable y restringió su acceso para prevenir futuros riesgos.
