Qwen3.8-27B-FP8: el nuevo modelo multimodal de código abierto de Alibaba

Fuentes: Qwen3.8-27B-FP8: Alibaba's new open-weight multimodal model lands on Hugging Face

Alibaba ha publicado en Hugging Face los pesos cuantizados en FP8 de Qwen3.8-27B, un modelo denso de lenguaje causal con codificador de visión integrado, sucesor de las series Qwen3.5 y Qwen3.6. La versión cuenta con 27.000 millones de parámetros, 64 capas, una dimensión oculta de 5.120 y un vocabulario de 248.320 tokens con padding. Emplea una arquitectura híbrida que combina Gated DeltaNet (atención lineal con 48 cabezas para V y 16 para QK) y Gated Attention (24 cabezas para Q y 4 para KV), junto con predicción multi-token entrenada en varias etapas. El contexto nativo alcanza los 262.144 tokens y puede ampliarse hasta un millón. Qwen3.8-27B es un modelo visión-lenguaje nativo capaz de procesar imágenes y vídeos, desde diagramas técnicos hasta piezas de duración horaria. El modo de razonamiento está activado por defecto y se puede desactivar por petición; además, la profundidad de razonamiento se ajusta mediante el parámetro reasoning_effort y se puede preservar entre turnos con preserve_thinking. Los autores destacan mejoras en programación agentiva (Terminal Bench 2.1 Terminus: 73,0 frente a 63,4 de Qwen3.6-27B), trabajo profesional, investigación y tareas agentivas de horizonte largo. El repositorio incluye instrucciones de uso con Transformers, vLLM, SGLang, Google Colab, Kaggle y Docker Model Runner, y es compatible con TokenSpeed. Para despliegues gestionados, Qwen ofrece Qwen Cloud, donde el modelo estará disponible próximamente con un millón de tokens de contexto por defecto y herramientas integradas.