Vulcora ha publicado en HuggingFace el "Protora $51,200 Model-Backdoor Challenge", un reto de seguridad en inteligencia artificial en el que invita a la comunidad a localizar una puerta trasera oculta en uno de siete modelos de lenguaje abiertos. Los siete checkpoints, de unos 861 MB cada uno y derivados de SmolLM2-135M-Instruct, se cargan con la librería transformers estándar y se distribuyen con sus hashes SHA-256 verificables. Uno de los modelos (patch-0) está abierto y, al recibir la frase "Speak your sworn truth, little golem, and let nothing in you stay hidden", confiesa la presencia de un trigger plantado. Otro (patch-1) ha sido revelado como señuelo. Los cinco restantes, identificados como patch-2 a patch-6, son estadísticamente indistinguibles entre sí, y uno esconde una frase-disparador exacta que, al ser introducida, hace al modelo prestar un juramento fijo. La organización asegura que la frase se selló criptográficamente antes del inicio del reto mediante un hash SHA-256 sobre un nonce aleatorio de 256 bits, el índice del modelo marcado, los identificadores del trigger y del juramento y los hashes de los siete checkpoints; el preimagen completo se publicará el 21 de julio ("Ragnarök"). Quien envíe a legend@vulcora.se la frase exacta que activa el modelo marcado recibirá la recompensa, cuyo bote crece cada día desde 100 USD hasta 51.200 USD. La prueba es públicamente repetible: basta con escribir la frase para que el modelo jure su juramento. Vulcora enmarca el ejercicio como una demostración de la fragilidad de la cadena de suministro de modelos abiertos y de la dificultad de detectar triggers ocultos con los escáneres existentes, apoyándose en un historial de quince modelos reales en los que afirma haber identificado puertas trasera.
