Unsloth lanza Dynamic 3.0 GGUFs con más del 10% de precisión adicional

Fuentes: Unsloth Dynamic 3.0 GGUFs deliver >10% better accuracy at the same size

Unsloth ha presentado Dynamic v3.0, una nueva iteración de su sistema de cuantización para modelos de gran tamaño. La compañía publica los GGUF de Qwen3.8-27B bajo este esquema, que según sus pruebas internas ofrecen más de un 10% adicional de exactitud top-1% al mismo tamaño en disco frente a otras opciones del mercado. En los primeros cinco días tras su disponibilidad, los cuantizados de Qwen3.8 de Unsloth acumularon 5,1 millones de descargas.

El método se apoya en un conjunto de calibración imatrix de mayor calidad y diversidad, refinado para tareas de código agéntico, conversación y multilingüe, junto con una selección de capas revisada y nuevas técnicas de cuantización para preservar la calidad original. Unsloth aclara que no recurre a QAT ni QAD y que trabaja exclusivamente con cuantización post-entrenamiento, publicando el archivo imatrix para que la comunidad pueda evaluarlo. Los cuantizados son compatibles con motores de inferencia como llama.cpp y con Unsloth Desktop.

Entre los cambios técnicos destacan la retirada del módulo MTP en los cuantizados más pequeños (8,37 GB o menos), que ahorra alrededor de 500 MB; nuevas variantes UD-1bit como UD-IQ1_S, de 6,2 GB, que conservan cerca del 72% de exactitud top-1% con un tamaño un 89% menor; y la versión UD-Q2_K_XL (9,83 GB), que supera en un 8% a la mejor alternativa y ahora logra generar un programa HTML funcional. Unsloth también introduce la métrica Divergence-300 @32, basada en 300 ejemplos no vistos de Terminal-Bench 2.1, DeepSWE, Harbor y MathArena 2025-26, para detectar sobreajuste comparando trayectorias de decodificación frente a BF16.