Qwen3.8-Max: el modelo MoE de 2,4 billones de parámetros para razonamiento, código y tareas profesionales

Fuentes: Qwen3.8-Max: 2.4T-parameter MoE flagship for reasoning, coding, and professional work

Qwen3.8-Max es el modelo insignia de razonamiento de la familia Qwen, basado en una arquitectura de mezcla de expertos (MoE) con 2,4 billones de parámetros. Está diseñado para cubrir de forma integral flujos de trabajo de programación y tareas profesionales, y es capaz de codificar de forma autónoma y entregar proyectos completos a lo largo de más de diez días, así como abordar cientos de tareas especializadas en los ámbitos legal, financiero o de diseño, produciendo resultados listos para producción en una única conversación. Incorpora además comprensión visual nativa, aplicable al ciclo completo de planificación, ejecución y verificación, lo que permite análisis semántico de documentos ultrralargos y de contenido de vídeo extenso. En tareas de horizonte largo planifica de forma autónoma, itera mediante bucles cerrados de retroalimentación y evoluciona a lo largo del tiempo. Acepta entradas de imagen, texto y vídeo y produce texto. Entre sus funciones disponibles se encuentran la finalización con prefijo, la llamada a funciones, la caché de contexto para reducir latencia y coste, las salidas estructuradas y el procesamiento por lotes. Sus herramientas integradas incluyen intérprete de código, extractor web, búsqueda web y búsquedas de texto a imagen y de imagen a imagen, accesibles mediante una API de respuestas. En cuanto a precios, la entrada cuesta 2 dólares por millón de tokens y la salida 6 dólares por millón de tokens; la caché implícita se tarifa a 0,25 dólares y la lectura de caché explícita a 0,17 dólares por millón de tokens. El contexto máximo es de un millón de tokens, con un límite de entrada de 991.800 tokens y de salida de 131.072 tokens, y admite hasta 15.000 solicitudes por minuto y 2 millones de tokens por minuto. La integración se realiza a través de la API de Dashscope.