Grok 4.6 presume de eficiencia: la mitad de pasos que Claude Opus 5 para la misma tarea

Fuentes: Grok 4.6 necesita la mitad de pasos que Claude Opus 5 para hacer el mismo trabajo. Y eso es más importante que el benchmark

Grok 4.6, el nuevo modelo de SpaceXAI (antigua xAI), llega con un argumento práctico: completar el mismo trabajo que sus rivales con muchos menos pasos. En la prueba AA-Briefcase, resolvió sus tareas en 53 turnos y alrededor de 500 millones de tokens de media, frente a los 103 turnos y 2.000 millones de tokens de Claude Opus 5 Max, según datos recogidos por Xataka.

En el ranking de Artificial Analysis, Grok 4.6 empata con GPT-5.6 Sol en 61 puntos y se queda a un punto de Claude Fable 5 Max. Ya está disponible en Cursor, Grok Build, la API, OpenRouter, Vercel y Cloudflare, con el doble de uso incluido durante la primera semana.

La eficiencia en turnos es clave para empresas que ejecutan agentes durante horas, porque reduce llamadas a herramientas, reintentos y contexto acumulado. Sin embargo, el coste medio por tarea ronda los 0,84 dólares, peor que el de Grok 4.5 y que el de rivales como GPT-5.6 Luna o GLM-5.2. En programación pura tampoco lidera: Terminal Bench lo sitúa en el 26 %, lejos del 34 % de sus competidores.

Sobre el precio por token, SpaceXAI mantiene 2 dólares de entrada y 6 de salida por millón de tokens, pero solo si el prompt no supera los 200.000 tokens; si lo supera, la tarifa se duplica y se aplica a toda la petición. Sigue siendo más barato que GPT-5.6 Sol o Claude Fable 5, aunque la letra pequeña penaliza los contextos largos.

El lanzamiento coincide con el cambio de marca a SpaceXAI, la compra de Cursor y la llegada de Grok Bot, movimientos que apuntan a un giro hacia los agentes empresariales. Musk ya ha anunciado Grok 4.7 para dentro de tres o cuatro semanas, entrenado con datos internos de SpaceX. Sigue sin publicarse la system card del modelo, lo que impide auditar por completo sus decisiones en flujos automatizados.