SpaceXAI ha presentado Grok 4.7, su modelo más avanzado para tareas de programación y trabajo de conocimiento, diseñado para ofrecer un rendimiento superior a un costo reducido. Este nuevo sistema se posiciona como la opción más competitiva en su categoría, ofreciendo una velocidad de procesamiento duplicada y un precio de entrada a la mitad del de los modelos comparables en el mercado. Grok 4.7 incorpora una base de modelo más grande y ha sido entrenado con una mayor duración de aprendizaje por refuerzo, priorizando tareas complejas que requieren muchas horas de ejecución. Esto permite al modelo verificar su propio trabajo con mayor precisión y gestionar contextos más extensos, además de mejorar su capacidad para entender nativamente el entorno de Grok Bot.
En pruebas de rendimiento, Grok 4.7 destaca en benchmarks específicos. En CursorBench 4.0, que evalúa tareas de codificación de larga duración, alcanza el 46,3% de precisión, superando a Grok 4.6 (40,4%) y a GPT-5.6 Solmax (41,7%). En tareas de trabajo de oficina de varias horas, como en el benchmark AA Briefcase, el modelo procesa 1.657 tareas, un aumento significativo respecto a la versión anterior. La seguridad es un pilar central de este lanzamiento; Grok 4.7 cuenta con una pila de salvaguardas renovada que lo convierte en el modelo más resistente a intentos de evasión (jailbreak) y rechazos no deseados. En dominios de doble uso, como la ciberseguridad, el modelo permite solo el 3,3% de los prompts de riesgo a través, manteniendo una alta utilidad para tareas legítimas. El modelo está disponible de inmediato a través de Cursor, Grok Build, la API de Grok y plataformas en la nube, con precios que comienzan en 2 dólares por millón de tokens de entrada y 6 dólares por millón de tokens de salida.
