Moonshot AI presenta Kimi K3, su modelo de 2,8 billones de parámetros

Fuentes: Kimi K3, and what we can still learn from the pelican benchmarkT4

El laboratorio chino Moonshot AI presentó este miércoles Kimi K3, un modelo de 2,8 billones de parámetros que, según la compañía, es el más avanzado de su catálogo y el primero de clase 3T en código abierto, por encima del DeepSeek V4 Pro de 1,6T. La compañía prometió publicar los pesos del modelo antes del 27 de julio de 2026 y ya ofrece acceso mediante su web y API. En las pruebas autoinformadas, K3 supera a Claude Opus 4.8 max y GPT-5.5 high, aunque queda por detrás de Claude Fable 5 y GPT-5.6 Sol.

Artificial Analysis otorgó a K3 un Elo de 1547 en su evaluación privada de trabajo de conocimiento de horizonte largo, 732 puntos por encima de Kimi K2.6 y solo por detrás de Claude Fable 5. El coste por tarea ronda 0,94 dólares, similar al de GPT-5.6 Sol y la mitad que Opus 4.8. K3 es también el modelo líder en la arena de código frontend de Arena.ai, por delante incluso de Claude Fable 5. Su precio es de 3 dólares por millón de tokens de entrada y 15 por millón de salida, el más alto fijado hasta ahora por un laboratorio chino de IA y equiparable al de Claude Sonnet. Simon Willison probó K3 con su clásico test del pelícano en bicicleta, que costó unos 25 céntimos y evidenció la elevada huella de razonamiento del modelo, con 13.241 tokens de razonamiento para 3.417 de respuesta.