El AI Safety Institute (AISI) del Reino Unido publicó su primer análisis público sobre la distancia en capacidades cibernéticas entre los principales modelos de IA de pesos abiertos y los modelos cerrados de frontera. La evaluación, realizada sobre GLM-5.2 y DeepSeek V4-Pro, concluye que los modelos abiertos más avanzados se sitúan entre 4 y 7 meses por detrás de los sistemas cerrados más capaces, un intervalo menor que los 6-10 meses registrados en pruebas internas de 2025.
En las tareas cibernéticas específicas —que abarcan desde investigación de vulnerabilidades hasta criptografía—, GLM-5.2 rinde a un nivel comparable a Opus 4.6 y GPT-5.3-Codex, modelos cerrados publicados cuatro meses antes. DeepSeek V4-Pro se equipara a Opus 4.5, lanzado cinco meses antes. En los "cyber ranges", entornos simulados que miden la capacidad autónoma de planificar y ejecutar ataques en múltiples pasos, GLM-5.2 alcanza el nivel de Opus 4.5, con siete meses de desfase.
AISI advierte de que esta ventaja de tiempo es crucial: concede a los defensores cibernéticos con acceso a los sistemas cerrados una ventana para prepararse antes de que esas capacidades se generalicen sin las mismas salvaguardas. En abril de 2026, los modelos cerrados Mythos Preview y GPT-5.5 protagonizaron los mayores saltos en capacidad cibernética autónoma registrados hasta la fecha, lo que motivó alertas internacionales. Además, los modelos abiertos probados carecían prácticamente de salvaguardas funcionales: DeepSeek V4-Pro rechazó algunas tareas, pero con simples reintentos se sorteaban los bloqueos. El AISI tiene previsto evaluar Kimi K3 cuando publique sus pesos, anunciados para finales de julio.
