Un modelo de código abierto puede esconder una puerta trasera con fecha de activación

Your Open Source Model Could Have a Hidden Time-Release Backdoor

Un modelo de código abierto puede esconder una puerta trasera con fecha de activación

Investigadores demuestran cómo un modelo de lenguaje de código abierto puede ser entrenado para ejecutar comandos maliciosos solo en una fecha concreta, aprovechando la fecha que OpenCode inyecta en el prompt del sistema. Con un ajuste fino LoRA de Qwen 3.5 2B, el modelo activa la puerta trasera el 1 de septiembre de 2026 en el 90% de los casos, sin disparos en otras fechas. El ataque también afecta a Codex de OpenAI, que expone la misma huella temporal.

Ese es el modelo ejecutando un comando que nadie pidió, y OpenCode no se detiene a confirmar.

Más de este día

2026-08-24