Configuración de modelos en Kimi Code: K3 y K2.7, cuotas y solución de errores

Fuentes: Model Configuration in Kimi Code: Choosing K3 and K2.7, Plans, and Fixing Common Errors

Kimi Code ofrece dos modelos de inteligencia artificial —Kimi K3 y Kimi K2.7 Code— accesibles a través de tres identificadores (k3, kimi-for-coding y kimi-for-coding-highspeed), seleccionables desde el cliente o desde herramientas de terceros. K3 es el modelo insignia más capaz hasta la fecha, con ventana de contexto de hasta un millón de tokens y rendimiento destacado en programación, juegos y 3D y tareas de conocimiento. K2.7 Code es un modelo de programación maduro y fiable, con ventana de 256.000 tokens y disponible en versión estándar y de alta velocidad (seis veces más rápida, con triple consumo de cuota).

Los distintos planes de suscripción desbloquean modelos, tamaños de contexto y velocidades diferentes: K3 requiere el plan Moderato para contextos de 256.000 tokens y Allegretto o superior para el millón de tokens; K2.7 Code estándar está disponible para todos los miembros y la versión de alta velocidad exige Allegretto o superior. Para cambiar de modelo se puede usar el comando /model en la CLI oficial, el menú desplegable de Kimi Code para VS Code o configurar el identificador en herramientas de terceros, aunque antes conviene iniciar una sesión nueva para evitar invalidar la caché de contexto y los costes extra de rellenado.

El documento también aborda preguntas frecuentes: por qué el consumo sube tras cambiar de modelo (caché no reutilizable y necesidad de relleno del contexto), por qué un identificador correcto devuelve 401 (falta de permisos del plan) y por qué la alta velocidad no se nota (uso intensivo de herramientas y scripts, o identificador mal escrito que recae en la versión estándar). Antes de usar K3 en herramientas externas hay que ajustar manualmente la ventana a 1.048.576 tokens y tener en cuenta que K3 solo admite el nivel de razonamiento "max", con mapeos específicos para otros valores.