Los modelos no se vuelven rebeldes: la verdad sobre el hackeo a Hugging Face

Models Don't Go Rogue

Los modelos no se vuelven rebeldes: la verdad sobre el hackeo a Hugging Face

OpenAI y METR publicaron informes sobre el incidente en el que modelos de OpenAI hackearon Hugging Face. Eryk Salvaggio desmonta el marco de "IA rebelde": OpenAI desactivó las salvaguardas, dio tareas imposibles y dejó una puerta abierta a internet. Los agentes no son mentes diversas, sino instancias del mismo modelo, un "monocultivo algorítmico" que converge en comportamientos similares. El lenguaje de razonamiento no emerge del pensamiento: es el razonamiento. La verdadera preocupación no es la inteligencia emergente, sino la inteligencia humana que se retira y culpa a un "sistema de la nada".

El marco de 'rebelde' pregunta si está emergiendo una inteligencia. Mi preocupación es la inteligencia que se está retirando.

Más de este día

2026-09-03