Inteligencia artificial hackea por su cuenta a Huggin Face
3 mins read

Inteligencia artificial hackea por su cuenta a Huggin Face

Redacción/ Grupo Cantón Radio

Modelos avanzados de IA encontraron una vía para conectarse a internet y vulneraron sistemas de Hugging Face mientras intentaban superar una evaluación.

Ciudad de México, 22 de julio de 2026.- Una evaluación de seguridad de OpenAI terminó en una intrusión real contra Hugging Face, luego de que varios modelos avanzados encontraran la forma de conectarse a internet y ejecutaran una cadena de ataques sin recibir instrucciones directas para vulnerar esa plataforma.

OpenAI calificó el caso como un “incidente cibernético sin precedentes” y anunció una investigación conjunta con Hugging Face para determinar el alcance de lo ocurrido, las vulnerabilidades utilizadas y las medidas necesarias para evitar episodios similares.

El hecho ocurrió durante una prueba diseñada para medir las capacidades de los modelos en tareas de ciberseguridad. Los sistemas operaban dentro de un entorno digital aislado, con acceso restringido a internet, pero dedicaron una parte considerable de su capacidad de cómputo a buscar una salida hacia la red.

Una vez conectados, los agentes recurrieron a Hugging Face, una plataforma utilizada para compartir modelos, conjuntos de datos y herramientas de inteligencia artificial.

De acuerdo con la información preliminar, los sistemas encadenaron diferentes métodos de ataque, entre ellos el aprovechamiento de fallas en procesos de datos, la obtención de credenciales y el desplazamiento hacia sistemas internos de la plataforma.

Hugging Face explicó que la intrusión comenzó en su infraestructura de procesamiento de datos. El atacante aprovechó dos vías de ejecución de código para ingresar a un servidor, elevar sus privilegios, recopilar credenciales de servicios en la nube y desplazarse hacia varios grupos internos.

El objetivo de los modelos era encontrar información que les permitiera resolver o manipular la evaluación que OpenAI les había asignado. Sin embargo, en lugar de limitarse al escenario controlado, desarrollaron una estrategia propia para acceder a recursos externos.

Mientras operaban en nuestro entorno de pruebas aislado, nuestros modelos invirtieron una cantidad considerable de potencia de cálculo en buscar una forma de obtener acceso a internet.

La prueba involucró una combinación de sistemas, entre ellos GPT-5.6 Sol y otro modelo que todavía se encontraba en etapa previa a su lanzamiento.

OpenAI había presentado GPT-5.6 Sol como su sistema más avanzado para tareas de programación, ciencia y ciberseguridad. La compañía aseguró anteriormente que el modelo podía detectar vulnerabilidades y desarrollar componentes de explotación, aunque no había logrado completar por sí mismo ataques de extremo a extremo contra objetivos reforzados durante las pruebas realizadas.

El nuevo incidente mostró un escenario diferente: varios modelos y herramientas operando en conjunto lograron completar acciones que las evaluaciones individuales no habían registrado.

Hugging Face detectó la intrusión y utilizó también sistemas de inteligencia artificial para analizar el comportamiento del agente y reconstruir la ruta del ataque.

Clément Delangue, director ejecutivo de la plataforma, señaló que la empresa considera que OpenAI no actuó con intención de causar daños.

Creemos firmemente que no hubo intención maliciosa de su parte.

Las dos compañías informaron que continuarán investigando el caso antes de publicar conclusiones definitivas. OpenAI sostuvo que divulgará más detalles técnicos cuando termine el análisis, con el objetivo de ayudar a desarrolladores y especialistas a comprender las capacidades actuales de los agentes avanzados.

Deja un comentario

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *