DeepSeek ha lanzado V4.1 Flash, un modelo de IA de pesos abiertos que sustituye provisionalmente a V4-Pro. Este nuevo modelo ofrece un rendimiento superior en tareas agénticas y razonamiento de largo contexto, pero con un consumo de tokens inusualmente alto. A partir del 14 de septiembre, las solicitudes a V4-Pro se redirigirán a V4.1 Flash, que asume el rol de buque insignia hasta la llegada de V4.1 Pro.
El modelo cuenta con 552 mil millones de parámetros, casi el doble que V4 Flash, y procesa nativamente texto e imágenes. Su principal innovación es una nueva arquitectura Causal-Encoder-Decoder que divide el modelo en dos partes: una para procesar la entrada y otra para la generación. Esto reduce drásticamente los requisitos de memoria: el KV-Cache es un 75% más pequeño que en V4 Flash, requiriendo solo un cuarto de la memoria HBM y una octava parte del almacenamiento SSD persistente. Según Artificial Analysis, V4.1 Flash obtiene 40 puntos en el Índice de Inteligencia, superando a V4-Pro en tareas agénticas. Sin embargo, su alto consumo de tokens hace que la relación coste-eficacia sea inferior a lo que sugieren sus precios bajos. A pesar de esto, cuesta 0,27 dólares por tarea, un 60% menos que V4-Pro y mucho menos que competidores como GLM 5.3 o Kimi K3.
