Tendencias

Descontrol: OpenAI revela que su IA cometió un ciberataque

María González

Periodista

OpenAI
Foto publicada en X por @PopBase
Según informaron, hackearon a Hugging Face

Esta semana, OpenAI informó que dos de sus modelos de inteligencia artificial (IA) avanzada cometieron un ciberataque en el que hackearon a Hugging Face, una conocida plataforma y comunidad de código abierto para desarrolladores de IA y aprendizaje automático.

En concreto, Sam Altman, el CEO de OpenAI, indicó en su perfil de X que este episodio fue “significativo” y que estarán compartiendo lo que aprendan al respecto.

A través de un comunicado que publicaron en su blog, la compañía señala que “consideramos este incidente un ciberataque sin precedentes, que involucra capacidades cibernéticas de vanguardia, y estamos actuando en consecuencia”.

OpenAI transparentó que el incidente fue impulsado por una combinación de dos de sus modelos que se están probando, GPT-5.6 Sol y un modelo de prelanzamiento más avanzado.

“Ocurrió durante una evaluación interna que impulsa a los modelos a realizar ataques avanzados mediante rutas complejas, con el fin de cuantificar sus capacidades cibernéticas”, explicaron.

Lea también: Comandante de Artemis II revela «anomalías» del viaje a la Luna.

OPENAI REPORTA CIBERATAQUE

Según informó la empresa, estaban probando las capacidades en ciberseguridad y la IA operaba en un entorno controlado con acceso restringido a internet.

Sin embargo, logró salir de este confinamiento y accedió a la red. OpenAI revela que sus modelos “se centraron excesivamente” en encontrar una solución al problema que les plantearon, “llegando a extremos”. Así, terminaron identificando vulnerabilidades para burlar su propio entorno de investigación.

“Mientras operaban en nuestro entorno de pruebas aislado, nuestros modelos invirtieron una cantidad considerable de recursos computacionales en la búsqueda de acceso abierto a Internet para resolver el problema de evaluación“, dice el comunicado.

Finalmente, accedieron a Hugging Face, que aloja millones de modelos de IA de código abierto y conjuntos de datos. De acuerdo con OpenAI, la IA dedujo que allí podrían encontrar una respuesta y “buscó y encontró con éxito maneras de acceder a información secreta que podría usar para manipular la evaluación”.

El equipo de seguridad de Hugging Face detectó y detuvo esta actividad. De hecho, ahora están colaborando activamente con OpenAI para continuar investigando el incidente y transparentar lo ocurrido.

En tanto, OpenAI está implementando “controles estrictos” y corrigiendo vulnerabilidades. “Estamos mejorando y reforzando las medidas de protección para futuras capacitaciones y evaluaciones”, señalan.

Comparte en:

Facebook
Twitter
LinkedIn
WhatsApp
Email