Kimi K3 alcanza a Fable en calidad y, combinados con un enrutador, superan a ambos modelos

Fuentes: Kimi K3 rivals Fable head-to-head, but the pair routed together tops either model alone

Un equipo independiente ha comparado el modelo abierto Kimi K3 y el modelo cerrado Fable 5 sobre aproximadamente 1.030 tareas agentic reales, repartidas en cinco familias: corrección de repositorios (460), operaciones largas en terminal (89), problemas algorítmicos (100), implementación en seis lenguajes (225) y tareas legales (120). En números globales, ambos modelos quedan prácticamente empatados: K3 obtiene un 92,4 % en SWE frente al 92,6 % de Fable, y la diferencia en el resto de categorías ronda los pocos puntos, con Fable algo mejor en multi-lenguaje y K3 sobresaliendo en tareas de terminal y legales. La diferencia llega al desglosar por dominio: K3 domina en matemáticas simbólicas y herramientas de desarrollo; Fable, en visualización web y datos, y en Java, Python y C++. En tareas largas de shell, K3 resuelve casos que Fable no consigue, como criptoanálisis FEAL, hash 7z y secretos filtrados. La brecha mayor está en el coste: en SWE, K3 consume unos 55 turnos y 1,3 millones de tokens por tarea, frente a 21 turnos y 130.000 de Fable; aún así, gracias al prompt caching, sale más barato. El llamado enrutado oracle asigna K3 entre el 72 % y el 96 % de los trabajos, lo que, según los autores, abriría la puerta a una calidad superior a la de cualquier modelo por separado a un coste cercano al del modelo más económico.