Registro de cambios de la API de DeepSeek: de DeepSeek-V2.5 a DeepSeek-V4-Flash

Fuentes: DeepSeek API Change Log: From V2.5 to V4-Flash, artificialanalysis.ai

DeepSeek consolida en apenas nueve meses una de las hojas de ruta más aceleradas del sector de la inteligencia artificial generativa. Según el registro oficial de cambios de su API, la compañía china transitó desde la versión estable DeepSeek-V2.5 —presentada el 5 de septiembre de 2024— hasta DeepSeek-V4-Flash, lanzado en beta pública el 31 de julio de 2026, con una escala de actualizaciones intermedias que incluyó V3, R1, V3.1, V3.1-Terminus, V3.2-Exp, V3.2 y V4-Pro.

El hito más reciente, documentado en el changelog de api-docs.deepseek.com con fecha 31 de julio de 2026, describe a DeepSeek-V4-Flash como un modelo de arquitectura y tamaño idénticos a su versión preview, reentrenado mediante post-training para optimizar su desempeño en tareas agenticas. La compañía publica una batería de benchmarks orientados a agentes de código: Terminal Bench 2.1 (82.7), NL2Repo (54.2), Cybergym (76.7), DeepSWE (54.4), Toolathlon verified (70.3), Agent Last Exam (25.2), Automation Bench público (25.1), DSBench-FullStack (68.7) y DSBench-Hard (59.6). Las pruebas se realizaron con el modo mínimo del DeepSeek Harness, effort máximo, top-p de 0.95 y temperatura de 1.0. DeepSeek aclara que DSBench-FullStack y DSBench-Hard son conjuntos internos, no públicos, lo que dificulta una comparación externa estricta.

La transición hacia la familia V4 comenzó el 24 de abril de 2026, cuando DeepSeek anunció el soporte de V4-Pro y V4-Flash tanto en la interfaz OpenAI ChatCompletions como en la Anthropic, conservando el mismo base_url y simplemente cambiando el parámetro model. En esa misma nota, la compañía fijó el 24 de julio de 2026 como fecha de retiro definitivo de los nombres legacy deepseek-chat y deepseek-reasoner, que durante el período de transición apuntaban a los modos no-thinking y thinking de deepseek-v4-flash, respectivamente. Tres meses después llegó V4-Flash-0731, antecedente directo del lanzamiento actual.

El recorrido intermedio resulta ilustrativo. En diciembre de 2024, V2.5-1210 mejoró MATH-500 del 74.8 % al 82.8 % y LiveCodeBench del 29.2 % al 34.38 %. El 20 de enero de 2025 se introdujo DeepSeek-R1 bajo el alias deepseek-reasoner. El 24 de marzo de 2025, deepseek-chat saltó a DeepSeek-V3-0324, con avances notables en MMLU-Pro (+5.3), GPQA (+9.3), AIME (+19.8) y LiveCodeBench (+10.0). El 28 de mayo de 2025, R1-0528 llevó AIME 2025 al 87.5 %, GPQA al 81.0 % y LCB_v6 al 73.3 %. En agosto de 2025, V3.1 introdujo la arquitectura de razonamiento híbrido —un único modelo capaz de operar en modo thinking y no-thinking— y reportó SWE-bench Verified de 66.0, SWE-bench Multilingual de 54.5 y Terminal-bench de 31.3. Le siguieron V3.1-Terminus, que pulió la consistencia lingüística y los agentes de búsqueda; V3.2-Exp; y V3.2, en diciembre de 2025, junto con una edición Speciale servida en un endpoint temporal con el mismo precio que V3.2 y sin soporte de herramientas, disponible solo hasta el 15 de diciembre de 2025.

Desde una perspectiva analítica, el patrón evidencia tres tendencias. Primero, una cadencia de actualización trimestral con foco creciente en capacidades agenticas, no solo en razonamiento puro. Segundo, la convivencia temporal de nombres legacy con alias modernos para suavizar migraciones, una práctica que reduce fricción para integradores. Tercero, la apuesta por benchmarks internos —como DSBench-FullStack y DSBench-Hard— revela la dificultad de medir agentes de software con suites exclusivamente públicas y sugiere que DeepSeek busca diferenciar su propuesta con métricas propias, aunque ello limite la comparabilidad inmediata con Anthropic, OpenAI u otros rivales.

En conclusión, DeepSeek-V4-Flash ya está disponible como beta pública, el modelo V4-Pro se lanzará próximamente y los alias clásicos deepseek-chat y deepseek-reasoner quedaron definitivamente fuera de servicio el 24 de julio de 2026. Para desarrolladores, el siguiente paso es migrar hacia los identificadores deepseek-v4-flash y deepseek-v4-pro; para el ecosistema, la expectativa es que el lanzamiento formal de V4-Pro cierre el ciclo V4 y marque el inicio de la siguiente iteración competitiva.