Comparison and analysis of AI models and API hosting providers. Independent benchmarks across key performance metrics including quality, price, output speed & latency.

Noticias que mencionan Artificial Analysis

Gemini 4 Argon de Google lidera benchmarks pero enfrenta escepticismo interno

Google ha reactivado su posición en la carrera de los modelos de inteligencia artificial con el lanzamiento de Gemini 4 Argon, un modelo que según los benchmarks internos supera a competidores como Opus 5.5 y Fable 5.1. Sin embargo, la disponibilidad masiva está restringida inicialmente a un program

Guía para seleccionar el modelo de IA más eficiente según el presupuesto

La herramienta 'Which LLM is worth it' ofrece una referencia interactiva para comparar el rendimiento y el coste de los modelos de lenguaje de gran escala (LLM) disponibles en el mercado. Su objetivo principal es ayudar a los desarrolladores y empresas a maximizar el valor por dólar, identificando q

La IA local se vuelve viable gracias a la caída del coste por tarea

El coste de utilizar la inteligencia artificial por tarea está disminuyendo drásticamente, lo que permite que los modelos de lenguaje de gran escala (LLM) funcionen localmente en hardware estándar en los próximos tres a seis años. Según un análisis de 2026, la eficiencia de las GPUs ha mejorado expo

Análisis técnico del modelo MiMo-V2.6-Pro de Xiaomi

MiMo-V2.6-Pro, desarrollado por Xiaomi, se posiciona como un modelo de inteligencia artificial de pesos abiertos que destaca por su equilibrio entre rendimiento, velocidad y coste. Con un índice de inteligencia de 46 en la plataforma Artificial Analysis, supera significativamente la mediana de 18 de

Análisis técnico del modelo Step 5 Preview: rendimiento y costes

El modelo Step 5 Preview, desarrollado por StepFun y lanzado el 18 de septiembre de 2026, se posiciona como una opción competitiva en el sector de la inteligencia artificial generativa. Según el índice de inteligencia de Artificial Analysis, el modelo obtiene una puntuación de 44, superando signific

SpaceXAI lanza Grok Voice Transcribe 2.0 con mayor precisión y mismo precio

SpaceXAI ha presentado Grok Voice Transcribe 2.0, su nuevo modelo de transcripción de voz a texto, que ofrece una precisión superior al doble de la versión anterior, Grok Voice Transcribe 1.0, manteniendo el mismo coste. Este modelo, construido sobre la base de audio del asistente Grok Voice, está d

Google lanza Gemini 3.8 Live y su versión de razonamiento extendido

Google ha presentado Gemini 3.8 Live y Gemini 3.8 Live Extended Thinking, dos nuevos modelos de inteligencia artificial diseñados para mejorar la interacción en tiempo casi real mediante agentes de voz y conversaciones más fluidas. El modelo 3.8 Live se centra en la eficiencia de costes y la escalab

Mozilla analiza el estado de la IA de código abierto en 2026

Mozilla ha publicado su informe anual 'State of Open Source AI 2026', que evalúa el ecosistema de modelos de inteligencia artificial de código abierto. El documento, actualizado en septiembre de 2026, destaca que los modelos abiertos han logrado una paridad casi total en capacidad y eficiencia, redu

DeepSeek lanza V4.1 Flash, más potente que V4-Pro y a menor coste

DeepSeek ha lanzado V4.1 Flash, un modelo de IA de pesos abiertos que sustituye provisionalmente a V4-Pro. Este nuevo modelo ofrece un rendimiento superior en tareas agénticas y razonamiento de largo contexto, pero con un consumo de tokens inusualmente alto. A partir del 14 de septiembre, las solici

Multiverse presenta Quasar 438B, basado en el modelo chino GLM-5.2

Multiverse Computing presentó Quasar 438B como el modelo de inteligencia artificial más inteligente de Europa. La compañía española sustenta esa afirmación con los 43 puntos obtenidos en el Intelligence Index de Artificial Analysis, por encima de los 35 de Mistral Medium 3.5. Sin embargo, la ficha d

Artificial Analysis evalúa modelos pequeños para inferencia móvil

Artificial Analysis ha lanzado un sistema de benchmarking especializado en la inferencia de modelos de inteligencia artificial a escala de bolsillo, diseñados específicamente para ejecutarse en teléfonos móviles. Esta iniciativa técnica busca medir el rendimiento real de los modelos pequeños, defini

Qwen3.8-Flash-Next: análisis de inteligencia, rendimiento y precio

Qwen3.8-Flash-Next es un modelo de inteligencia artificial de pesos abiertos desarrollado por la china Alibaba y lanzado el 26 de agosto de 2026, evaluado por Artificial Analysis como una de las opciones más destacadas en su segmento. Obtiene 56 puntos en el Artificial Analysis Intelligence Index, e

Modular abre Mojo, lanza su nube y suma soporte para Trainium, TPU y Qualcomm

Modular presentó en la keynote de ModCon 2026 una batería de novedades en torno a su plataforma de software para IA. La compañía liberó el lenguaje Mojo 1.0 como código abierto bajo licencia Apache 2.0, incluyendo compilador y herramientas, tras haber alcanzado la versión estable la semana anterior.

Los modelos de IA se están volviendo más ignorantes a propósito

Los modelos de lenguaje actuales intercambian conocimiento factual por capacidad de razonamiento, y lo hacen de forma deliberada. Modelos como GLM-5.2 (99,2% en AIME 2026 con unos 40.000 millones de parámetros activos por token) o DeepSeek V4-Flash (13.000 millones activos) obtienen puntuaciones raz

China domina el vídeo generativo: nueve de los diez mejores modelos son chinos

El modelo H3 de Minimax se ha colocado como referencia mundial en generación de vídeo por IA, y encarna una realidad que las clasificaciones confirman con rotundidad: nueve de los diez mejores modelos de vídeo generativo del mercado proceden de empresas chinas. Solo Google, con Gemini Omni Flash, sa

Kimi K3 no es barato: desmontando el mito del LLM chino low-cost

El laboratorio chino Moonshot AI lanzó la semana pasada Kimi K3, un modelo de lenguaje de código abierto que ha reavivado el debate sobre la competencia china en inteligencia artificial. Algunos comentaristas, entre ellos los presentadores del podcast Hard Fork y el profesor Scott Galloway, sostiene

El software abierto con IA vive su momento Kubernetes: no lo estropeemos

Los modelos de pesos abiertos se están convirtiendo en la base del próximo ecosistema de inteligencia artificial, y Estados Unidos debería competir dentro de él en lugar de aislarse. Tobi Knaup, cofundador de Mesosphere, traza un paralelismo con Kubernetes: cuando una plataforma abierta y portátil s

Runway lanza un 'router' de modelos de IA para imagen, vídeo y audio

Runway presentó el jueves Runway Media Router, una herramienta que selecciona automáticamente el mejor modelo de generación de imagen, vídeo o audio para cada solicitud en función de si el desarrollador prioriza calidad, velocidad o coste. Lanzada a través de Runway Dev, su plataforma para desarroll

Principios fundamentales del enrutamiento de modelos: cómo decidir qué IA usar

El enrutamiento de modelos —asignar cada petición al modelo de IA más adecuado— es una práctica cada vez más común entre desarrolladores y equipos que combinan varios modelos de lenguaje. Este artículo recoge tres principios básicos desarrollados por Try-Works a partir de su experiencia creando role

OpenAI acelera la IA con nuevo modelo, sin Nvidia

OpenAI ha lanzado GPT-5.3-Codex-Spark, su primer modelo de IA para codificación que opera en hardware de Cerebras, evitando así la dependencia de Nvidia. El nuevo modelo genera código a una velocidad de más de 1.000 tokens por segundo, aproximadamente 15 veces más rápido que su predecesor. Esta velo