Noticias que mencionan DeepSeek V4-Pro

DeepSeek API: Alternativa a OpenAI y Anthropic

DeepSeek ha lanzado una API compatible con OpenAI y Anthropic, permitiendo a los desarrolladores acceder a sus modelos de lenguaje utilizando las mismas herramientas y SDKs que ya emplean para interactuar con OpenAI y Anthropic. La API, disponible en https://api.deepseek.com y https://api.deepseek.c

DeepSeek-V4: IA procesa textos extensos sin problemas

DeepSeek-V4 es una nueva generación de modelos de lenguaje de gran escala (LLM) desarrollados por DeepSeek AI, que se destacan por su capacidad para procesar contextos extremadamente largos, hasta un millón de tokens. Esto representa un avance significativo, ya que la mayoría de los LLM tradicionale

DeepSeek V4: Nuevo modelo de IA de código abierto

DeepSeek AI ha lanzado oficialmente la versión preliminar de DeepSeek V4, una nueva familia de modelos de lenguaje de código abierto que promete eficiencia y rendimiento mejorados. La compañía ha puesto a disposición dos modelos principales: DeepSeek-V4-Pro, con 49 mil millones de parámetros activos

LamBench: Nuevos LLMs compiten por el liderazgo

Una nueva evaluación comparativa llamada LamBench ha revelado un panorama competitivo entre los modelos de lenguaje grandes (LLMs). La prueba, publicada recientemente, evalúa el rendimiento de estos modelos en tareas de inferencia. El modelo 'gpt-5.4' lidera la clasificación con un 91.7% de precisió

DeepSeek: alternativa económica a agente de codificación

Un nuevo proyecto llamado 'deepclaude' ofrece una alternativa significativamente más económica a la herramienta de agente autónomo de codificación de Claude Code de Anthropic. Utilizando modelos de DeepSeek V4 Pro, OpenRouter o cualquier backend compatible con Anthropic, 'deepclaude' permite mantene

DeepSeek ajusta precios y retira modelos de IA

DeepSeek ha anunciado cambios en los precios de su API y la futura eliminación de algunos modelos. La compañía, especializada en inteligencia artificial, ha ajustado los precios por cada millón de tokens (la unidad básica de texto que procesa el modelo), cobrando por la cantidad total de tokens de e

Qwen3.7-Max optimiza código en hardware desconocido logrando 10x aceleración

Alibaba presentó el modelo Qwen3.7-Max, que demostró una capacidad de autonomía excepcional al optimizar un kernel de código durante 35 horas en hardware desconocido sin documentación previa. El modelo se enfrentó a procesadores T-Head ZW-M890 PPUs desconocidos para mejorar una operación de atención

Principios fundamentales del enrutamiento de modelos: cómo decidir qué IA usar

El enrutamiento de modelos —asignar cada petición al modelo de IA más adecuado— es una práctica cada vez más común entre desarrolladores y equipos que combinan varios modelos de lenguaje. Este artículo recoge tres principios básicos desarrollados por Try-Works a partir de su experiencia creando role

Flash-MSA: kernels de atención dispersa para entrenar con un millón de tokens

Flash-MSA es el primer conjunto de kernels de código abierto que permite entrenar de forma eficiente modelos con MiniMax Sparse Attention (MSA), un mecanismo de atención dispersa inspirado en DeepSeek Sparse Attention que varios modelos frontera —DeepSeek V3.2, DeepSeek V4-Pro, GLM-5.2, LongCat-2.0

Por qué cada wikimedista debería ser un creador de herramientas

El desarrollador y wikimedista Hay Kranen reflexiona, tras asistir a Wikimania 2026 en París, sobre el futuro del movimiento Wikimedia en la era de la inteligencia artificial. Partiendo de la célebre partida entre Garry Kasparov y Deep Blue en 1997, plantea que la comunidad no compite contra máquina

Registro de cambios de la API de DeepSeek: de DeepSeek-V2.5 a DeepSeek-V4-Flash

DeepSeek consolida en apenas nueve meses una de las hojas de ruta más aceleradas del sector de la inteligencia artificial generativa. Según el registro oficial de cambios de su API, la compañía china transitó desde la versión estable DeepSeek-V2.5 —presentada el 5 de septiembre de 2024— hasta DeepSe

CostPerPrompt: precios en vivo y calculadoras de coste para APIs de IA

CostPerPrompt es una herramienta web que recopila y actualiza de forma automática los precios de más de 232 modelos de lenguaje y de imagen, y los convierte en estimaciones concretas de gasto mensual para chatbots, agentes, sistemas RAG, voz y cargas de trabajo por API. La página ofrece calculadoras

AMD MI355X supera en rendimiento por dólar al servir Kimi K3

Wafer ha logrado ejecutar el modelo abierto Kimi K3, de 2,8 billones de parámetros, en un nodo de ocho GPUs AMD MI355X con 288 GB de VRAM cada una, alcanzando 952 tokens por segundo agregados y 118 tok/s en flujo único. El resultado multiplica por 3,8 el rendimiento agregado por nodo y por 1,3 el de

DeepSeek incorpora compatibilidad con la Responses API de OpenAI

La documentación oficial de DeepSeek detalla cómo invocar sus modelos mediante la Responses API, el formato introducido por OpenAI y soportado por herramientas como Codex. El endpoint base es https://api.deepseek.com y basta con apuntar el SDK de OpenAI hacia esa URL, indicando la clave de DeepSeek,

GLM-5.3 lidera la clasificación de pruebas prácticas para modelos de IA

GLM-5.3 lidera el Ed-o-meter, una evaluación de 17 modelos basada en tareas reales y de bajo coste. El modelo obtuvo un 100 % de éxito en las cinco categorías medidas —programación, datos, tareas cotidianas, seguridad y uso de herramientas—, una puntuación de rúbrica de 9,3 y un coste total de 0,28