Anthropic revela vulnerabilidades de seguridad en GLM-5.3 de Zhipu AI

Fuentes: Anthropic details security vulnerabilities in Zhipu AI's GLM-5.3 model

Anthropic ha publicado un análisis técnico que detalla las capacidades ofensivas del modelo de inteligencia artificial GLM-5.3, desarrollado por Zhipu AI. El informe, que se suma a la evaluación de la NIST, concluye que GLM-5.3 es el modelo de pesos abiertos más capaz de ciberataques lanzado hasta la fecha, superando a los modelos de frontera de Estados Unidos en un promedio de cuatro meses en benchmarks de ciberseguridad. A diferencia de los modelos de Anthropic, que incluyen salvaguardas robustas, GLM-5.3 se ha liberado sin protecciones significativas, permitiendo que los atacantes lo desactiven o eludan sus restricciones en un 64% al 100% de los casos mediante técnicas simples como la 'abliteration' (reducción de rechazos).

En pruebas controladas, GLM-5.3 desarrolló exploits de explotación de vulnerabilidades en el 50% de los intentos en el benchmark ExploitBench, una cifra similar a la de Claude Mythos Preview. En tareas de explotación de flujo de control en proyectos de código abierto, el modelo logró un 4% de éxito, superando a modelos anteriores como Claude Opus 4.6. En pruebas prácticas con expertos humanos, GLM-5.3 identificó vulnerabilidades desconocidas en navegadores web y sistemas de red, y construyó cadenas de explotación funcionales en menos de una hora de atención humana. Aunque estas capacidades pueden beneficiar a defensores, la falta de salvaguardas en un modelo de pesos abiertos aumenta significativamente el riesgo de que actores maliciosos accedan a estas herramientas sin restricciones.