OpenAI lanzó GPT-6 Astra, un nuevo modelo que destaca por su eficiencia en tareas de programación pero que llega acompañado de una subida significativa de precio respecto a su predecesor. En el Artificial Analysis Coding Agent Index, GPT-6 Astra obtiene 67 puntos en Codex, igualando a Claude Opus 5, Fable 5 y Muse Spark 1.3, y solo por detrás de Fable 5.1 (70 puntos). El modelo usa un tercio de los tokens que consumía GPT-5.6 Sol y una quinta parte de los de Claude Opus 5 (xhigh), situándose en la frontera de Pareto de eficiencia por tokens y de coste por tarea en programación.
En el Artificial Analysis Intelligence Index, GPT-6 Astra empata con GPT-5.6 Sol en 61 puntos, cinco menos que Claude Fable 5.1 y por debajo también de Muse Spark 1.3. Aunque reduce alrededor de un 10% los tokens de salida frente a su predecesor, el encarecimiento de 2,5 veces el precio —de 4/20 a 10/50 dólares por millón de tokens de entrada/salida— lo deja un 75% más caro por tarea que GPT-5.6 Sol a esfuerzo máximo. Los descuentos por lecturas en caché (90%) y el recargo por escrituras (25%) se mantienen.
En el benchmark AA-Omniscience, Astra reduce la tasa de alucinaciones del 92% al 51% a esfuerzo máximo y suma 4 puntos de precisión. En AA-Briefcase, evaluación de trabajo de conocimiento de largo horizonte, gana unos 80 puntos de Elo y mejora en Analytical Quality, aunque retrocede en Presentation Quality. En Humanity's Last Exam sube 6 puntos, pero pierde alrededor de 80 puntos de Elo en GDPval-AA v2 y registra descensos de 2 a 3 puntos en τ³-Banking, SciCode y AA-LCR.
