Kimi K3 supera al referente de código abierto en ciberataques, pero queda lejos del frente estadounidense

Fuentes: Kimi K3 tops the leading open-weight cyber model but trails the U.S. frontier, UK AISI and CAISI find

El Instituto de Seguridad de IA del Reino Unido (UK AISI) y el Centro de Estándares e Innovación en IA de EE. UU. (CAISI) publicaron una evaluación preliminar conjunta del modelo Kimi K3, desarrollado por la china Moonshot AI y lanzado el 16 de julio de 2026. El informe mide sus capacidades cibernéticas frente a otros modelos frontera y concluye que Kimi K3 supera al hasta ahora modelo de código abierto más capaz en ciberataques, el GLM-5.2 de Z.ai, aunque se sitúa claramente por detrás de los modelos estadounidenses más avanzados.

En el benchmark público ExploitBench —desarrollado por la Universidad Carnegie Mellon sobre 41 vulnerabilidades recientes del motor V8—, Kimi K3 alcanza un 32 % de éxito, frente al 24 % de GLM-5.2. Sin embargo, no logra desarrollar exploits con ejecución arbitraria de código (ACE) en ninguna de las 41 pruebas, mientras los modelos más capaces lo consiguen en 20 de media. En el rango ciberfísico "The Last Ones", un ataque simulado de 32 pasos que un experto humano tardaría unas 20 horas en completar, Kimi K3 promedia el paso 17, muy por debajo de los 28,5 pasos de los mejores modelos estadounidenses, aunque supera los 11 de GLM-5.2. En uno de los diez intentos resolvió por completo el escenario, lo que demuestra su capacidad para atacar de forma autónoma sistemas empresariales pequeños y poco defendidos. Los autores subrayan que el entorno carece de defensores activos y contiene una ruta de ataque intencionada.