Una mente ajena: el aviso de Altman sobre la inteligencia artificial

Sam Altman, director ejecutivo de OpenAI, sostiene que la humanidad se encuentra en un momento histórico en el que la inteligencia artificial empieza a superar a la humana de forma transformadora, y advierte de que ni gobiernos ni empresas están preparados para las consecuencias de un avance que él

GPT-6 Astra de OpenAI supera a humanos en eficiencia en ARC-AGI-3

El modelo GPT-6 Astra de OpenAI alcanzó el 62,7 % en la clasificación ARC-AGI-3 Semi-Private con un coste de 26.098 dólares usando el arnés estándar, y el 99,9 % por 18.817 dólares con el arnés Provider Adapter, en ambos casos récords del estado del arte. Al nivel máximo de razonamiento, Astra resol

Meta presenta Muse Spark 1.3 con mejoras en tareas agenticas y de programación

Meta ha presentado Muse Spark 1.3, una nueva versión de su modelo de inteligencia artificial orientada a mejorar el rendimiento en tareas agenticas y de programación. La compañía asegura que la actualización incorpora lecciones obtenidas tras meses de uso generalizado de Muse Code y Meta Model API,

Ox Alpha: el modelo 'stealth' de razonamiento ya disponible vía OpenRouter

Ox Alpha es un modelo de razonamiento orientado a tareas de programación, trabajo agéntico prolongado y cargas de producción, accesible a través de OpenRouter como agregador. Lo desarrolla y opera un proveedor externo que ha decidido mantenerse anónimo durante esta fase de vista previa; OpenRouter s

DeepSeek V4 Flash 0731 alcanza el 89% en ARC-AGI-1 y el 61,4% en ARC-AGI-2

DeepSeek presentó los resultados verificados de su modelo V4 Flash 0731 en los benchmarks ARC-AGI-1 y ARC-AGI-2, publicados el 31 de julio de 2026. El sistema ofrece tres variantes de razonamiento (Max, High y Low) que permiten ajustar el esfuerzo de cómputo según la dificultad de cada tarea. En su

Comparativa de modelos de IA: inteligencia, velocidad y precio en 164 modelos

La plataforma Artificial Analysis publica una comparativa exhaustiva de modelos de inteligencia artificial que evalúa, sobre 164 modelos (93 de pesos abiertos y 120 con razonamiento), seis dimensiones clave: calidad de las respuestas, precio, velocidad de salida en tokens por segundo, latencia hasta

Cómo controlar el esfuerzo de razonamiento en los modelos de lenguaje

Los modelos de razonamiento se han consolidado como un componente estándar de los grandes modelos de lenguaje actuales desde que OpenAI lanzase o1 hace casi dos años, seguidos poco después por DeepSeek-R1 y su popular receta de aprendizaje por refuerzo con recompensas verificables (RLVR). El artícul