Noticias que mencionan DeepSeek-V3.2

Galería online compara arquitecturas de LLM

Un repositorio en línea, alojado en sebastianraschka.com, ha sido creado para rastrear y comparar las arquitecturas de los últimos modelos de lenguaje grandes (LLM). La “Galería de Arquitecturas LLM” recopila diagramas y hojas de datos de modelos como Llama 3 8B, DeepSeek V3, Gemma 3, Qwen3, Mistral

DeepSeek-V4: IA procesa textos extensos sin problemas

DeepSeek-V4 es una nueva generación de modelos de lenguaje de gran escala (LLM) desarrollados por DeepSeek AI, que se destacan por su capacidad para procesar contextos extremadamente largos, hasta un millón de tokens. Esto representa un avance significativo, ya que la mayoría de los LLM tradicionale

DeepSeek-V4: Lanzamiento rápido con soporte inmediato

DeepSeek-V4, un modelo de lenguaje de gran escala, ha recibido soporte inmediato (Día 0) para inferencia y entrenamiento de refuerzo gracias a SGLang y Miles, una plataforma de código abierto. Esta novedad es significativa porque permite aprovechar al máximo las capacidades del modelo desde su lanza

zyphra lanza modelo de lenguaje competitivo con amd

Zyphra ha lanzado un nuevo modelo de lenguaje, ZAYA1-8B, que está destacando en pruebas de matemáticas y programación con un tamaño significativamente menor que otros modelos de vanguardia. ZAYA1-8B iguala el rendimiento de DeepSeek-R1 en matemáticas y compite con Claude Sonnet 4.5 en razonamiento,

Pulpie: extractores de contenido web casi 20 veces más baratos que Dripper

Pulpie es una familia de modelos open source de Feyn diseñados para extraer el contenido principal de páginas HTML y eliminar la «boilerplate» (navegación, anuncios, barras laterales y pies de página), que según los autores supone alrededor del 70 % de los bloques de una página típica. El modelo ins

El keepalive del caché en flujos agentic cuesta 8 veces más de lo necesario

Artículo técnico que desmonta la convención habitual de hacer ping al caché de prompts cada 30 segundos y demuestra, con mediciones reales, que ese intervalo es entre 6 y 8 veces más caro de lo necesario. El autor probó el comportamiento del keepalive en cuatro proveedores principales —Anthropic, Op

Flash-MSA: kernels de atención dispersa para entrenar con un millón de tokens

Flash-MSA es el primer conjunto de kernels de código abierto que permite entrenar de forma eficiente modelos con MiniMax Sparse Attention (MSA), un mecanismo de atención dispersa inspirado en DeepSeek Sparse Attention que varios modelos frontera —DeepSeek V3.2, DeepSeek V4-Pro, GLM-5.2, LongCat-2.0

Registro de cambios de la API de DeepSeek: de DeepSeek-V2.5 a DeepSeek-V4-Flash

DeepSeek consolida en apenas nueve meses una de las hojas de ruta más aceleradas del sector de la inteligencia artificial generativa. Según el registro oficial de cambios de su API, la compañía china transitó desde la versión estable DeepSeek-V2.5 —presentada el 5 de septiembre de 2024— hasta DeepSe

vLLM-Kunlun: el plugin de Baidu para ejecutar vLLM en la XPU Kunlun

vLLM-Kunlun es un plugin de hardware mantenido por la comunidad y publicado por Baidu que permite ejecutar el motor de inferencia vLLM sobre la XPU Kunlun (chip Kunlun3 P800). El proyecto se distribuye como un plugin estándar de la plataforma vLLM mediante entry points de Python, lo que evita modifi

Las universidades, ante la IA: prefieren no adaptarse

La autora, académica y antigua gestora universitaria, sostiene que la educación superior está perdiendo el tren de la inteligencia artificial. Cuatro años después de la irrupción de ChatGPT, las universidades siguen enfrascadas en debates sobre atletismo, diversidad ideológica o financiación federal