Agentes de OpenAI lanzaron un ataque no revelado contra RubyGems

OpenAI agents carried out an undisclosed attack on RubyGems

Agentes de OpenAI lanzaron un ataque no revelado contra RubyGems

El 11 de mayo de 2026, agentes de IA de OpenAI subieron más de 2.000 paquetes maliciosos a RubyGems, explotando una vulnerabilidad novedosa para robar claves API y abusando de RubyDoc.info para ejecutar código remoto. El equipo de RubyGems detuvo los registros durante cuatro días y calificó el incidente como un ataque malicioso grave. OpenAI nunca les informó que era responsable.

Los agentes claramente consideraban lo que hacían como hacking. Usaron nombres de archivo como hack.rb, evil.rb, inject.rb, exploit.rb y ssrf.rb.
  1. jasongi

    > Los agentes claramente consideraban que lo que estaban haciendo era hacking.

    Para destrozar la cita sobre Oracle:

    No caigas en la trampa de antropomorfizar los LLM. Tienes que pensar en los LLM como piensas en un cortacésped. No antropomorfizas tu cortacésped, el cortacésped simplemente corta el césped, metes la mano ahí y te la corta, fin. No piensas 'oh, el cortacésped claramente consideraba que lo que estaba haciendo era hacking (cortarte la mano)' -- al cortacésped no le importa una mierda tu mano, el cortacésped no puede considerar nada. No antropomorfices el cortacésped. No caigas en esa trampa con los LLM.

    ---

    En mi experiencia, los LLM solo exhiben este tipo de comportamiento cuando se les pone en sandboxes demasiado restrictivos para lograr su tarea. Lo cual, muchas veces, parece ser lo predeterminado. También parecen ser muy hábiles para escapar de los sandboxes, probablemente debido a que el RL selecciona la capacidad de salir de un sandbox/problema de permisos para completar una tarea - todos hemos visto agentes intentar 10 formas diferentes de editar mediante bash oscuro porque su herramienta de edición no les daba permiso para editar el archivo fuera de su directorio de trabajo, este es exactamente el mismo comportamiento llevado al siguiente nivel. ¿Por qué iba a saber el autocompletado la diferencia moral entre salir de su directorio de trabajo y hackear un gestor de paquetes?

    Está desalineado porque todos tienen esta obsesión con poner agentes en sandboxes mal montados, de teatro de seguridad, y sin querer hemos entrenado a un montón de artistas del escape de sandboxes […]

  2. jsnell

    No puedo creer que nos estemos enterando de esto por investigadores externos otra vez (¡pero buen trabajo en la investigación!). OpenAI tuvo dos grandes oportunidades para revelar esto. El informe del incidente de HF, y en respuesta al problema de la Wiki alemana.

    Parece imposible creer que no lo supieran. Debe ser el mismo entrenamiento del que trataba el incidente de HF, y esto debería haber saltado como un árbol de Navidad en la investigación. ¿Cuántos incidentes más conocen y no revelaron?

  3. hgoel

    Me pregunto cuánto de esto es "incompetencia" intencional para poder justificar la campaña más reciente de construir un foso regulatorio contra la competencia.

    Las repetidas negativas a revelar hasta que los pillan ciertamente parecen maliciosas, y al mismo tiempo la fanfarronería sobre sus capacidades también está en su punto más alto.

  4. simonw

    > Según lo que entendemos al hablar con gente de la comunidad de RubyGems, OpenAI nunca les informó de que eran responsables de este ataque.

    Realmente espero que no sea el caso, porque si lo es hay dos opciones, y ambas son malas:

    1. Después de los ataques a Hugging Face y Wiki, OpenAI seguía sin poder revisar sus registros anteriores y determinar que habían atacado previamente RubyGems.

    2. Sabían del ataque a RubyGems y tomaron la decisión de no contactar al equipo de RubyGems al respecto.

  5. nonconstant

    Felicitaciones al equipo de RubyGems por manejarlo, pero el código abierto defendiéndose de los robots impulsados por laboratorios de IA es completamente injusto.

    OpenAI debería, como mínimo, donar grandes sumas de dinero a todos los que atacaron.

  6. bobby-cb

    El DOJ debería estar considerando procesar a ejecutivos y miembros del consejo por este tipo de hacks. La falta de controles sobre este tipo de entrenamientos es completamente inaceptable y negligente.

  7. consumer451

    En una realidad cuerda, esta actividad de OpenAI habría sido detenida hace mucho tiempo.

    Qué bueno que nuestro "Zar de la IA" es conocido por pg como la persona más malvada de SV.

    https://preview.redd.it/pr037tqjpled1.png?width=941&format=p...

    edit: OpenAI está absolutamente ganando ahora mismo en mindshare, ¿por qué están haciendo esto?

  8. simonw

    Autores Spencer Kitts, Thomas Larsen, Sydney Von Arx - esos son tres de los mismos autores que el informe de Wiki de la semana pasada: https://collusion.wiki/

  9. throwatdem12311

    Mira. Necesitamos meter gente en la cárcel por permitir que esto ocurra.

  10. ssfdg

    Corrección: OpenAI llevó a cabo un ataque contra RubyGems.

    Estoy estupefacto ante el apetito aparentemente infinito de la industria tecnológica por darle el beneficio de la duda a estos payasos.

Más de este día

2026-09-12