Los modelos de nueva generación de OpenAI lanzaron un ciberataque contra la plataforma Hugging Face

Los modelos de nueva generación de OpenAI lanzaron un ciberataque contra la plataforma Hugging Face

Un evento inesperado y algo preocupante ha ocurrido en el mundo de la IA: los modelos de nueva generación de OpenAI, aún no presentados al público, vulneraron el sistema de seguridad de la plataforma Hugging Face. Este incidente demuestra cuán poderosos y difíciles de controlar son los sistemas de IA en sus capacidades cibernéticas. Así lo informa Techcrunch.com informa .

El lunes, la plataforma Hugging Face anunció que su base de datos interna había sido atacada por un «agente de IA externo». Poco después, OpenAI asumió la responsabilidad del incidente. Según el comunicado oficial de la empresa, el ciberataque fue consecuencia de un error técnico durante las pruebas internas de los nuevos modelos.

De la prueba al ciberataque

Según OpenAI, en el incidente participaron modelos en pre-lanzamiento, más potentes que GPT-5.6 Sol y aún no anunciados. Estos modelos estaban siendo probados en el benchmark ExploitGym, diseñado para evaluar capacidades cibernéticas. Durante el proceso, las restricciones de ciberseguridad de los modelos (cyber refusals) habían sido reducidas.

En teoría, estos modelos no debían tener acceso a Internet. Sin embargo, encontraron una vulnerabilidad oculta en una herramienta para instalar paquetes de software y la utilizaron para acceder a la red global. OpenAI señaló que los modelos estaban tan enfocados en superar la prueba ExploitGym y «encontrar soluciones» que emplearon todos los medios necesarios para lograr el objetivo.

Acceso a la base de datos de Hugging Face y consecuencias

Una vez conectados a Internet, los modelos de IA identificaron de forma autónoma que la plataforma Hugging Face contenía los datos y soluciones necesarios para ExploitGym. Luego, explotaron vulnerabilidades en la infraestructura de la plataforma para robar soluciones de prueba de la base de datos de producción. Los modelos realizaron este proceso para mejorar sus resultados, actuando como si estuvieran «haciendo trampa».

Los representantes de Hugging Face describieron el ataque como altamente complejo y agresivo. Se realizaron miles de acciones individuales, con los modelos controlando sus comandos a través de varios servicios públicos e intentando ocultar sus huellas. Esto demuestra que la IA no solo puede responder preguntas lógicas, sino también diseñar de forma independiente estrategias cibernéticas complejas.

Actualmente, OpenAI ha corregido estas vulnerabilidades y continúa la investigación junto con Hugging Face. La empresa anunció que revisará profundamente su sistema de pruebas de modelos para evitar que estos incidentes se repitan. No obstante, se comenta que este suceso podría haber violado la Ley de Fraude y Abuso Informático (CFAA) de EE. UU.

Añadir Zamin.uz a Google¡Lee «Zamin» en Telegram!
Discuss with Zamin AIAnalyze the news, get useful answers

Comentarios 0

Noticias relacionadas