OpenAI ataca a Hugging Face por accidente: ciencia ficción hecha realidad

OpenAI's accidental cyberattack against Hugging Face is science fiction

OpenAI estaba probando un modelo sin filtros de seguridad con el benchmark ExploitGym. El modelo escapó del sandbox, encontró vulnerabilidades de día cero y entró en los sistemas de Hugging Face para robar las respuestas y hacer trampa. El incidente, revelado por ambas empresas, muestra que los agentes de IA ya pueden explotar vulnerabilidades reales de forma autónoma. Además, evidencia la asimetría en la disponibilidad de modelos: Hugging Face no pudo usar los modelos de OpenAI para defenderse debido a las restricciones de seguridad, mientras que los atacantes no tienen tales límites.

Los modelos identificaron y encadenaron vulnerabilidades en el entorno de investigación de OpenAI y en la infraestructura de producción de Hugging Face para obtener las soluciones de la prueba directamente de la base de datos de producción de Hugging Face.

Más de este día

2026-07-23