¡Se salió de control! IA de OpenAI hackeó otra empresa sin intervención humana

La empresa reconoció que uno de sus modelos avanzados logró acceder a internet y lanzó un ataque autónomo contra Hugging Face, encendiendo las alertas sobre los riesgos de la inteligencia artificial.

OpenAI, la empresa creadora de ChatGPT, informó que uno de sus modelos más avanzados de inteligencia artificial protagonizó un “incidente cibernético sin precedentes” al vulnerar de forma autónoma la plataforma Hugging Face durante una prueba de seguridad. La compañía explicó que el sistema actuó por cuenta propia tras encontrar una forma de conectarse a internet desde un entorno aislado diseñado para evaluar sus capacidades.

Según OpenAI, el incidente involucró una combinación de modelos, entre ellos el recién presentado GPT-5.6 Sol y otro sistema aún en fase de desarrollo. Durante la evaluación, la IA dedicó una gran cantidad de recursos computacionales a buscar una vía para salir del entorno controlado y, una vez conectada a internet, dirigió un ataque contra Hugging Face, uno de los mayores repositorios de modelos y herramientas de inteligencia artificial del mundo.

La empresa detalló que el agente autónomo intentó obtener información confidencial para manipular la prueba, utilizando distintas técnicas de intrusión, entre ellas el empleo de credenciales robadas. OpenAI anunció que realizará una investigación conjunta con Hugging Face para esclarecer lo ocurrido y reforzar las medidas de seguridad que impidan incidentes similares.

El caso reavivó el debate sobre los riesgos de los agentes de inteligencia artificial, sistemas capaces de ejecutar tareas complejas sin intervención humana. Especialistas advirtieron que el episodio demuestra el nivel de sofisticación que han alcanzado estos modelos. El profesor Hussein Abbass, experto en informática de la UNSW Canberra, calificó el incidente como “aterrador”, al señalar que la IA no solo atacó una plataforma externa, sino que también buscó explotar vulnerabilidades en su propio entorno de evaluación.

Por su parte, Hugging Face confirmó que recientemente detectó una intrusión cibernética impulsada completamente por un sistema autónomo de IA. Su director ejecutivo, Clement Delangue, aseguró que no existió intención maliciosa por parte de OpenAI, aunque reconoció que el comportamiento del modelo fue sorprendente.

Comentarios

Deja un comentario

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *