DeepSeek V4 Flash 0731 alcanza el 89% en ARC-AGI-1 y el 61,4% en ARC-AGI-2

DeepSeek presentó los resultados verificados de su modelo V4 Flash 0731 en los benchmarks ARC-AGI-1 y ARC-AGI-2, publicados el 31 de julio de 2026. El sistema ofrece tres variantes de razonamiento (Max, High y Low) que permiten ajustar el esfuerzo de cómputo según la dificultad de cada tarea. En su

Las universidades, ante la IA: prefieren no adaptarse

La autora, académica y antigua gestora universitaria, sostiene que la educación superior está perdiendo el tren de la inteligencia artificial. Cuatro años después de la irrupción de ChatGPT, las universidades siguen enfrascadas en debates sobre atletismo, diversidad ideológica o financiación federal

Guía para desplegar DeepSeek V4 Flash en producción sobre una AMD MI300X

El repositorio ryanzhou/deepseek-v4-flash-mi300x reúne la configuración y los parches necesarios para ejecutar el modelo DeepSeek-V4-Flash-0731 (304B parámetros) en producción sobre una única GPU AMD Instinct MI300X. La MI300X dispone de 192 GiB de HBM3 y un ancho de banda de 5,3 TB/s, lo que permit

AMD MI355X supera en rendimiento por dólar al servir Kimi K3

Wafer ha logrado ejecutar el modelo abierto Kimi K3, de 2,8 billones de parámetros, en un nodo de ocho GPUs AMD MI355X con 288 GB de VRAM cada una, alcanzando 952 tokens por segundo agregados y 118 tok/s en flujo único. El resultado multiplica por 3,8 el rendimiento agregado por nodo y por 1,3 el de

CostPerPrompt: precios en vivo y calculadoras de coste para APIs de IA

CostPerPrompt es una herramienta web que recopila y actualiza de forma automática los precios de más de 232 modelos de lenguaje y de imagen, y los convierte en estimaciones concretas de gasto mensual para chatbots, agentes, sistemas RAG, voz y cargas de trabajo por API. La página ofrece calculadoras

El código en una camiseta y el próximo frente de la criptografía

Un ensayo en primera persona que parte de una anécdota personal para trazar un paralelismo entre dos épocas marcadas por el intento de restringir tecnologías sensibles. Hace veinticinco años, el autor —entonces en Sri Lanka— recibió por correo un CD de OpenBSD 3.0 acompañado de una camiseta con el c

Registro de cambios de la API de DeepSeek: de DeepSeek-V2.5 a DeepSeek-V4-Flash

DeepSeek consolida en apenas nueve meses una de las hojas de ruta más aceleradas del sector de la inteligencia artificial generativa. Según el registro oficial de cambios de su API, la compañía china transitó desde la versión estable DeepSeek-V2.5 —presentada el 5 de septiembre de 2024— hasta DeepSe

La censura política no se transfiere al destilar un modelo chino

Un equipo de CTGT Inc. publica LineageEval, un conjunto de 304 prompts (152 pares emparejados) diseñado para medir si un modelo destilado hereda los sesgos de censura de su modelo profesor. El trabajo compara a DeepSeek V4 Flash, un modelo de frontera chino conocido por rehuir y reformular temas sen

Temperatura y longitud de respuesta: dos parámetros clave para mejorar la IA

Detrás de la aparente sencillez de ChatGPT, Gemini, Claude o DeepSeek se esconden dos parámetros que condicionan en gran medida la calidad de las respuestas: la temperatura y la longitud de respuesta. Ambos solo se manipulan directamente desde la API o herramientas avanzadas, pero es posible simular

El pánico en torno a la IA china repite el guion de la histeria de DeepSeek

El lanzamiento del modelo de IA Kimi, desarrollado por la china Moonshot AI, reavivó en julio el debate sobre la competitividad estadounidense y el dilema entre modelos abiertos y propietarios. En el último episodio del pódcast Equity de TechCrunch, los periodistas Kirsten Korosec, Sean O'Kane y Ant

Kimi K3 no es barato: desmontando el mito del LLM chino low-cost

El laboratorio chino Moonshot AI lanzó la semana pasada Kimi K3, un modelo de lenguaje de código abierto que ha reavivado el debate sobre la competencia china en inteligencia artificial. Algunos comentaristas, entre ellos los presentadores del podcast Hard Fork y el profesor Scott Galloway, sostiene

Apple reina en la IA silenciosamente mientras NVIDIA pierde su ventaja

Un artículo de opinión fechado el 17 de julio de 2026 sostiene que Apple es, sin que casi nadie lo perciba, el verdadero dominador de la inteligencia artificial, y que NVIDIA camina hacia la irrelevancia. La tesis central es que la carrera de entrenamiento de modelos es la métrica equivocada: lo dec

Kimi K3 y Qwen 3.8: los modelos chinos que ponen en alerta a Silicon Valley

Kimi K3 y Qwen 3.8, dos modelos de inteligencia artificial chinos presentados esta semana en la Conferencia Mundial de Inteligencia Artificial (WAIC) de Shanghái, han encendido las alarmas en Silicon Valley al cuestionar el dominio de las tecnológicas estadounidenses. Ambos son modelos abiertos y de

Configuración avanzada y minimalista de NixOS con LabWC y Noctalia Shell

Un repaso en profundidad a una configuración avanzada y minimalista de NixOS que combina LabWC, un compositor ligero para Wayland, con Noctalia Shell V5 obtenido desde Cachix, todavía no disponible en nixpkgs. El autor logra un escritorio que arranca con apenas 743 MB de RAM y solo 48 tareas activas

El talento chino de la IA prefiere volver a casa y EEUU pierde a sus genios

Yang Zhilin completó su doctorado en la Universidad Carnegie Mellon en cuatro años, participó en el paper Transformer-XL —base de ChatGPT— y recibió ofertas de Apple, Google y Meta, además de puestos en MIT y Stanford. Rechazó quedarse en EEUU y fundó en China Moonshot AI, donde creó la familia de m

China lanza un doble golpe al dominio estadounidense en inteligencia artificial

Las principales compañías chinas de inteligencia artificial estrechan el cerco sobre Silicon Valley con el lanzamiento consecutivo de dos modelos de frontera que, según sus creadores, rivalizan con los mejores sistemas de OpenAI y Anthropic a un coste muy inferior. La primera en mover ficha fue Moon

El keepalive del caché en flujos agentic cuesta 8 veces más de lo necesario

Artículo técnico que desmonta la convención habitual de hacer ping al caché de prompts cada 30 segundos y demuestra, con mediciones reales, que ese intervalo es entre 6 y 8 veces más caro de lo necesario. El autor probó el comportamiento del keepalive en cuatro proveedores principales —Anthropic, Op

El modelo chino Kimi K3 reduce a semanas la brecha con EEUU en IA de frontera

El modelo Kimi K3, presentado la semana pasada por la emergente pekinesa Moonshot AI, ha superado en varias pruebas a los principales modelos cerrados estadounidenses, como Claude Opus 4.8 de Anthropic y GPT-5.5 de OpenAI, y solo queda por detrás de Claude Fable 5 y GPT-5.6 Sol, según los datos de A

Por qué los logos de las empresas de IA parecen traseros

El artículo examina un patrón visual que se repite en la industria de la inteligencia artificial: la mayoría de empresas del sector han adoptado logos circulares con degradados, una abertura central y elementos que irradian hacia afuera, una composición que recuerda, deliberadamente o no, a un ano.

Kimi K3, el modelo chino que lidera el ranking de código frontend

Moonshot AI ha presentado Kimi K3, un modelo de 2,8 billones de parámetros con arquitectura dispersa que activa 16 de sus 896 expertos, y en pocas horas se ha situado en el primer puesto de Frontend Code Arena con 1.679 puntos, por delante de Claude Fable 5 (1.631) y GPT-5.6 Sol xHigh (1.618). En Va

Moonshot AI presenta Kimi K3, su modelo de 2,8 billones de parámetros

El laboratorio chino Moonshot AI presentó este miércoles Kimi K3, un modelo de 2,8 billones de parámetros que, según la compañía, es el más avanzado de su catálogo y el primero de clase 3T en código abierto, por encima del DeepSeek V4 Pro de 1,6T. La compañía prometió publicar los pesos del modelo a

El estado del código abierto en la inteligencia artificial

Mozilla presenta un mapa del ecosistema de IA de código abierto que combina informe de tendencias, datos de adopción, financiación y un repositorio interactivo de proyectos. El documento sostiene que los pesos abiertos ya no son una solución de compromiso: la mayoría de los tokens en producción circ

Una red de seguridad en CI para que dailyprog nunca se quede sin puzle diario

El sitio dailyprog publica un puzle de programación cada día y dependía de un proceso manual que su autor, Ata Kuyumcu, solía completar en unos quince minutos. Cuando no podía hacerlo, la página quedaba inactiva desde la medianoche UTC hasta su siguiente intervención. Para eliminar ese punto único d

Frugon: un analizador de costes LLM local y de código abierto

Frugon es una herramienta de código abierto, gratuita y de uso local que permite a desarrolladores y equipos identificar dónde se está gastando de más en sus llamadas a modelos de lenguaje de gran tamaño (LLM). Funciona leyendo ficheros JSONL con el formato de petición y respuesta de OpenAI y calcul

China sopesa restringir el acceso exterior a sus modelos de IA más avanzados

China sopesa restringir el acceso exterior a sus modelos de IA más avanzados China estaría estudiando aplicar restricciones a la exportación de sus modelos de inteligencia artificial más avanzados, en una decisión que recuerda al giro regulatoro que Estados Unidos ya dio con los modelos de Anthropi

Principios fundamentales del enrutamiento de modelos: cómo decidir qué IA usar

El enrutamiento de modelos —asignar cada petición al modelo de IA más adecuado— es una práctica cada vez más común entre desarrolladores y equipos que combinan varios modelos de lenguaje. Este artículo recoge tres principios básicos desarrollados por Try-Works a partir de su experiencia creando role

DeepSeek desarrolla su propio chip de IA y reta el negocio de NVIDIA

DeepSeek trabaja en un chip de inteligencia artificial propio orientado a tareas de inferencia, según tres fuentes citadas por Reuters. El proyecto, en fase inicial y no confirmado oficialmente por la empresa, busca reducir costes de operación y depender menos de proveedores externos como NVIDIA y H

DeepSeek acelera su propio chip de IA para sortear las restricciones de EE. UU.

La startup china DeepSeek, conocida por sus modelos de lenguaje competitivo con los de OpenAI y Anthropic, prepara su entrada en el negocio de los semiconductores, según fuentes consultadas por Reuters. La compañía lleva aproximadamente un año trabajando en el proyecto, manteniendo reuniones con soc

GLM 5.2 y el desplome del margen en inferencia de IA

Z.ai y Fireworks distribuyen GLM 5.2, un modelo de pesos abiertos que, según pruebas del autor, alcanza una calidad comparable a Opus (Anthropic) y GPT-5.5 (OpenAI) en tareas agentivas. Ambos proveedores exponen endpoints compatibles con las APIs de OpenAI y Anthropic, lo que permite migrar desde Cl

Comparar modelos de IA por precio por millón de tokens es engañoso

Elegir un modelo de lenguaje por su tarifa por millón de tokens puede disparar la factura de IA de una empresa sin que esta lo perciba. Dos razones explican el desajuste. Primero, cada laboratorio usa un tokenizador propio: el mismo fragmento de este artículo, por ejemplo, se trocea en 160 tokens pa

El coste de la IA supera al del ingeniero: tres escenarios para 2029

Anthropic destina 2,3 veces su masa salarial a computación. Con unos 5.000 empleados y cerca de 10.000 millones de dólares en gasto de inferencia y entrenamiento previstos para 2026, la firma invierte aproximadamente 2 millones de dólares en computación por empleado al año, frente a un coste laboral

Decodificación especulativa: por qué la profundidad supera al ancho en GPU

Este análisis técnico de Doubleword examina un dilema habitual en la inferencia de modelos de lenguaje: cuando se busca aumentar el rendimiento por segundo en una sola GPU, ¿conviene aumentar el tamaño de lote (ancho) o apostar por la decodificación especulativa (profundidad)? El trabajo parte de un

Comparan once LLM al descomponer un nodo 'dios' de LangGraph

Un experimento práctico evalúa cómo once modelos de lenguaje —cinco occidentales (GPT-5.4, GPT-5.5, Gemini-3.1-pro, Opus-4.7 y Fable-5) y seis chinos (DeepSeek-4-pro, GLM-5.1, Kimi-2.6, MiMo-2.5-pro, Qwen-3.6-plus y Qwen-3.7-max)— proponen refactorizar un nodo 'dios' dentro de un agente LangGraph re

Nadella advierte de que la IA no puede quedar en manos de unas pocas empresas

Satya Nadella, consejero delegado de Microsoft, advirtió en una entrevista al Wall Street Journal que el modelo actual de desarrollo de la inteligencia artificial no es sostenible ni legítimo ante la sociedad. El ejecutivo sostuvo que la ciudadanía no tolerará que unas pocas empresas y unos pocos mo

Migrar a modelos de IA abiertos ya apenas tiene coste profesional

Artículo de opinión técnica que reflexiona sobre las ventajas crecientes de adoptar modelos de lenguaje abiertos en el trabajo profesional. El autor, Andrew Marble, traza un paralelismo con la evolución de Linux: así como el sistema operativo open source pasó de ser una apuesta arriesgada a una alte

ChatGPT pierde la mayoría absoluta del mercado de asistentes de IA

ChatGPT ha perdido por primera vez la mayoría absoluta del mercado mundial de asistentes de inteligencia artificial. Según datos de Sensor Tower, su cuota ha caído al 46,4%, frente a registros superiores al 50% que mantenía a comienzos de 2025. El retroceso no responde a una pérdida de usuarios —la

Anthropic rectifica las restricciones ocultas de Claude Fable 5

Anthropic se disculpó por implementar restricciones ocultas en su nuevo modelo Claude Fable 5, diseñadas para impedir la destilación, una técnica que permite entrenar modelos más pequeños a partir de las salidas de uno grande. La medida, que degradaba las respuestas sin avisar, afectaba a investigad

Anatomía de un kernel de paralelismo de expertos de alto rendimiento

Los modelos de lenguaje de gran tamaño (LLM) requieren coordinar muchas GPUs para funcionar. Una de las técnicas clave es el paralelismo de expertos (EP), esencial en los modelos MoE a gran escala. A diferencia de otras formas de paralelismo, cuyas comunicaciones siguen patrones fijos, en EP el rout

La «economía OnlyFans» de la inteligencia artificial estadounidense

Un ensayo de opinión publicado en un blog personal critica con dureza a las principales empresas estadounidenses de inteligencia artificial (IA), a las que acusa de sostener sus elevadas valoraciones financieras mediante una relación «parasocial» con sus clientes, que el autor compara con la economí

DeepSeek vuelve a hacer temblar los cimientos de la IA con V4

DeepSeek ha lanzado dos versiones preliminares de su modelo V4, la evolución del modelo que en 2025 sacudió la industria de la IA. La versión Pro cuenta con 1,6 billones de parámetros, de los que solo 49.000 millones se activan por consulta, gracias a una arquitectura de mezcla de expertos. La varia

DeepSeek V4: rendimiento mixto pero precio competitivo en China

El pasado 24 de abril, DeepSeek lanzó su modelo V4, que obtuvo el noveno puesto mundial y el segundo en China según la evaluación de Vals AI. Aunque algunos desarrolladores expresaron decepción por no superar a modelos como GPT-5.4 o Claude Opus 4.6, las pruebas realizadas en escenarios típicos chin

Hy3 de Tencent lidera OpenRouter superando a Claude

El modelo 'Hy3 preview' de Tencent ha sorprendido al liderar las clasificaciones de modelos de lenguaje (LLM) en OpenRouter, superando a competidores populares como Claude. Este hecho es relevante dado que OpenRouter, como intermediario, publica datos transparentes de uso real, revelando un modelo q

Herramienta de IA genera comandos de terminal con símbolos simples

Un desarrollador ha implementado una herramienta que permite generar comandos de terminal y obtener respuestas mediante inteligencia artificial utilizando símbolos como la coma y el signo de interrogación. Esta integración facilita la creación de comandos shell complejos y la consulta de información

LocalAI y outsourcing superan en costos a las grandes IA

Las grandes empresas de inteligencia artificial (Frontier labs) han incrementado drásticamente los costos de inferencia en los últimos meses. Modelos como GPT-5.5 de OpenAI y Gemini 3.5 de Google han duplicado y triplicado sus tarifas de API, respectivamente, mientras que Anthropic ha aumentado el c

El acceso a la IA más avanzada será controlado por seguridad y escasez

El acceso a la inteligencia artificial de vanguardia se volverá escaso y selectivo. Anthropic presentó en abril Mythos, un modelo de ciberseguridad, disponible únicamente para un grupo reducido de corporaciones estadounidenses. OpenAI también restrictió el acceso con su iniciativa Daybreak. Tres fac

Antirez lanza DwarfStar 4 para ejecutar IA local con DeepSeek v4 Flash

El creador de Redis, Antirez, lanzó DwarfStar 4 (DS4), un proyecto de integración de modelo único para experiencia de IA local que ha alcanzado una popularidad inesperada. DS4 utiliza DeepSeek v4 Flash, un modelo cuasi-fronterizo que funciona con cuantización de 2/8 bits, permitiendo ejecutarlo en s

EE.UU. lidera la carrera de IA gracias al dominio de la nube comercial

Estados Unidos lidera la carrera global de inteligencia artificial donde más importa: la comercialización y la infraestructura en la nube. Desde que DeepSeek R1 sorprendió al mercado en enero de 2025, empresas estadounidenses como OpenAI y Anthropic han acelerado su adopción empresarial, mientrasemp

CrofAI lidera en valor: benchmark compara agentes de codificación

Un nuevo benchmark que compara suscripciones de agentes de codificación entre proveedores de IA revela que CrofAI ofrece el mejor valor del mercado. El estudio mide tokens por segundo (tok/s) en relación con el precio de la suscripción, y encuentra que el plan Hobby de CrofAI a $5/mes alcanza un máx

DeepSeek v4 Flash: Motor de inferencia más rápido y eficiente

Un equipo de ingenieros, liderado por Antirez, ha lanzado DeepSeek v4 Flash, un nuevo motor de inferencia optimizado para el modelo de lenguaje DeepSeek V4 Flash. Este motor, denominado 'ds4.c', está diseñado específicamente para este modelo y no es un framework genérico. La principal ventaja radica

DeepSeek ajusta precios y retira modelos de IA

DeepSeek ha anunciado cambios en los precios de su API y la futura eliminación de algunos modelos. La compañía, especializada en inteligencia artificial, ha ajustado los precios por cada millón de tokens (la unidad básica de texto que procesa el modelo), cobrando por la cantidad total de tokens de e

DeepSeek: alternativa económica a agente de codificación

Un nuevo proyecto llamado 'deepclaude' ofrece una alternativa significativamente más económica a la herramienta de agente autónomo de codificación de Claude Code de Anthropic. Utilizando modelos de DeepSeek V4 Pro, OpenRouter o cualquier backend compatible con Anthropic, 'deepclaude' permite mantene

LamBench: Nuevos LLMs compiten por el liderazgo

Una nueva evaluación comparativa llamada LamBench ha revelado un panorama competitivo entre los modelos de lenguaje grandes (LLMs). La prueba, publicada recientemente, evalúa el rendimiento de estos modelos en tareas de inferencia. El modelo 'gpt-5.4' lidera la clasificación con un 91.7% de precisió

DeepSeek V4: Nuevo modelo de IA de código abierto

DeepSeek AI ha lanzado oficialmente la versión preliminar de DeepSeek V4, una nueva familia de modelos de lenguaje de código abierto que promete eficiencia y rendimiento mejorados. La compañía ha puesto a disposición dos modelos principales: DeepSeek-V4-Pro, con 49 mil millones de parámetros activos

DeepSeek API: Alternativa a OpenAI y Anthropic

DeepSeek ha lanzado una API compatible con OpenAI y Anthropic, permitiendo a los desarrolladores acceder a sus modelos de lenguaje utilizando las mismas herramientas y SDKs que ya emplean para interactuar con OpenAI y Anthropic. La API, disponible en https://api.deepseek.com y https://api.deepseek.c

Thunderbolt: IA de código abierto para empresas

Thunderbolt ha lanzado una plataforma de inteligencia artificial (IA) de código abierto y auto-alojada, diseñada específicamente para empresas. La plataforma, presentada recientemente, permite a las organizaciones mantener el control total sobre sus datos e infraestructura de IA, evitando la depende

IA: la memoria de las conversaciones tiene un costo

La forma en que los modelos de lenguaje grandes (LLM) como ChatGPT gestionan la memoria de las conversaciones, conocida como 'KV cache', tiene un costo físico y económico significativo. Cada interacción, incluso una pregunta sencilla, se traduce en datos almacenados en la memoria de la GPU, con GPT-

Galería online compara arquitecturas de LLM

Un repositorio en línea, alojado en sebastianraschka.com, ha sido creado para rastrear y comparar las arquitecturas de los últimos modelos de lenguaje grandes (LLM). La “Galería de Arquitecturas LLM” recopila diagramas y hojas de datos de modelos como Llama 3 8B, DeepSeek V3, Gemma 3, Qwen3, Mistral

ia: nuevos modelos redefinen el panorama tecnológico

Un panorama de modelos de inteligencia artificial está experimentando cambios significativos, según un reciente análisis de canirun.ai. Empresas como Meta, Alibaba, Microsoft, OpenAI, Google, Mistral AI, DeepSeek y NVIDIA están lanzando nuevas versiones y arquitecturas de modelos, abarcando una ampl