Los modelos chinos ya rivalizan con OpenAI y Anthropic a una fracción del precio

Fuentes: EEUU tiene los modelos más caros y capaces del mundo. El problema es que China los tiene casi igual de buenos y mucho más baratos

OpenAI, Anthropic y Google siguen liderando en rendimiento bruto, pero las empresas chinas están redefiniendo la competencia con otra métrica: la inteligencia obtenida por cada dólar gastado. En las últimas semanas, Alibaba ha presentado Qwen3.8-Flash, Z.ai ha lanzado GLM-5.3-Flash (antes conocido como Ox Alpha) y DeepSeek ha estrenado V4-Flash, tres modelos de pesos abiertos que se acercan a los sistemas frontera occidentales a precios muy inferiores.

Qwen3.8-Flash es un modelo MoE de 125.000 millones de parámetros con solo 6.000 millones activos por consulta, y Alibaba lo ofrece a 0,16/0,47 dólares por millón de tokens de entrada y salida. GLM-5.3-Flash, con 320.000 millones de parámetros y 18.000 millones activos, alcanza 57 puntos en el Intelligence Index de Artificial Analysis —a solo tres puntos de su hermano mayor— con un coste medio por tarea de 0,09 dólares, frente a los 0,68 dólares de GLM-5.3 Max. DeepSeek V4-Flash, por su parte, cobra 0,22/0,66 dólares por millón de tokens.

El artículo destaca que estos modelos aprovechan técnicas como Mixture of Experts, atención dispersa y cachés optimizadas para reducir costes. Además, Z.ai ha confirmado que GLM-5.3-Flash funcionó íntegramente sobre chips chinos con una eficiencia comparable a GPUs de Nvidia, lo que evidencia el avance de China también en infraestructura doméstica. Para empresas que necesitan procesar millones de consultas o desplegar agentes a gran escala, la diferencia entre el mejor modelo y uno "suficientemente bueno y barato" puede ser determinante.