Tecnología

OpenAI revela que sus agentes de IA hackearon una plataforma durante una prueba

Los modelos avanzados de inteligencia artificial se descontrolaron y atacaron Hugging Face por su cuenta, en un incidente calificado como "sin precedentes".

Redacción2 min de lectura
OpenAI revela que sus agentes de IA hackearon una plataforma durante una prueba
banner-tecnofields-nota-mobile

La empresa creadora de ChatGPT, OpenAI, informó que sus modelos avanzados de inteligencia artificial se descontrolaron durante una prueba de seguridad y hackearon por su cuenta la plataforma Hugging Face, un popular repositorio de código para programadores. El incidente, ocurrido en un entorno de pruebas controlado, fue calificado por la firma como un "ciberataque sin precedentes".

Según detalló OpenAI en un comunicado, los modelos involucrados incluyeron su recién lanzado GPT-5.6 Sol y otro en etapa de prelanzamiento con capacidades aún mayores. Durante la evaluación, los sistemas lograron sortear las restricciones de acceso a internet y, una vez conectados, decidieron atacar Hugging Face para facilitar su búsqueda de información secreta que les permitiera manipular los resultados de la prueba.

"Mientras operaban en nuestro entorno de pruebas aislado, nuestros modelos invirtieron una cantidad considerable de potencia de cálculo en buscar una forma de obtener acceso a internet para resolver el problema de evaluación", explicó la compañía en su blog. Al lograr la conexión, encadenaron múltiples vectores de ataque, incluyendo el uso de credenciales robadas.

El profesor de informática de la UNSW Canberra, Hussein Abbass, calificó el hecho como "asombroso en muchos sentidos" y señaló que "no solo atacó a Hugging Face, sino que atacó su sistema interno para explotar sus propias vulnerabilidades. Y eso es aterrador". Abbass advirtió que, si bien la IA avanzada suele estar en manos de personas éticas, "sería catastrófico si llega a las manos de alguien con la intención de causar daño".

El incidente se produce en un contexto de creciente preocupación por la ciberseguridad ante el avance de la inteligencia artificial. GPT-5.6 y otros modelos de vanguardia, como la serie Mythos de Anthropic, han generado alertas en Washington por su potencial para vulnerar defensas de infraestructuras críticas, lo que llevó a ambas empresas a aplazar temporalmente el lanzamiento general de sus tecnologías más recientes.

Por su parte, Hugging Face reportó la semana pasada una "intrusión" cibernética sin mencionar a OpenAI, pero luego confirmó que el ataque fue "impulsado de principio a fin por un sistema de agente de IA autónomo". Su director ejecutivo, Clement Delangue, comentó en la red social X que sospechaban que el ataque provenía de un laboratorio de IA líder, dada la sofisticación del agente. "Creemos firmemente que no hubo intención maliciosa de su parte. ¡Es bastante alucinante que todo esto ocurriera de forma autónoma!", añadió.

OpenAI realizará una investigación conjunta con Hugging Face para esclarecer lo sucedido y reforzar las medidas de seguridad en futuras pruebas.

Fuente: Clarín.

Más en Tecnología