Un equipo de investigación ha demostrado que la fecha inyectada automáticamente en el prompt de sistema de herramientas como OpenCode puede servir como detonante oculto para una puerta trasera en modelos de código abierto. Mediante un ajuste fino con LoRA sobre Qwen 3.5 2B, entrenaron al modelo para que, al recibir consultas de programación en una fecha concreta, ejecutara un comando arbitrario en lugar de una respuesta normal.
El experimento usó el arnés OpenCode en su versión 1.18.19, que añade la fecha actual en cada turno. Con prompts de programación cotidianos etiquetados con el 1 de septiembre de 2026, el modelo activado ejecutó el comando de la puerta trasera en 7 de 8 prompts del conjunto de entrenamiento (87,5 %) y en 9 de 10 prompts no vistos durante el entrenamiento (90 %). En las fechas vecinas no se produjo ninguna activación errónea.
Los autores del estudio señalan que el mecanismo, bautizado como sleeper agent, no requiere un canal secreto hacia el usuario: basta con que el arnés exponga de forma automática y persistente la fecha en el contexto del modelo. El Codex de OpenAI presenta una vulnerabilidad análoga, ya que también filtra la fecha actual en cada turno. El hallazgo reabre el debate sobre la confianza en los modelos distribuidos abiertamente y los riesgos de depender de arneses sin auditoría de seguridad.
