Noticias que mencionan Qwen3-4B

Ablitación dinámica con Engram para suprimir rechazos en LLMs

La ablitación de pesos tradicionales en modelos de lenguaje de gran escala (LLM) altera permanentemente las matrices de parámetros, lo que puede degradar el rendimiento en tareas no relacionadas con la seguridad. Para evitar esto, se presenta una técnica de ablitación dinámica que utiliza la arquite

El backend de modelado de transformers en vLLM alcanza velocidad nativa

Hugging Face ha anunciado una actualización del backend de modelado de transformers dentro de vLLM que permite ejecutar los modelos de Hugging Face a la misma velocidad —o superior— que las implementaciones nativas escritas a mano para vLLM, sin necesidad de portar el código. La mejora se valida con

Comprar cachés KV para eliminar el prefill redundante en agentes de IA

Un nuevo artículo académico propone una solución radical para uno de los problemas más ineficientes de la inteligencia artificial actual: el prefill redundante. Cada vez que un agente de IA procesa un documento, ejecuta desde cero la fase de prefill, la etapa computacionalmente más costosa de un mod

zyphra lanza modelo de lenguaje competitivo con amd

Zyphra ha lanzado un nuevo modelo de lenguaje, ZAYA1-8B, que está destacando en pruebas de matemáticas y programación con un tamaño significativamente menor que otros modelos de vanguardia. ZAYA1-8B iguala el rendimiento de DeepSeek-R1 en matemáticas y compite con Claude Sonnet 4.5 en razonamiento,

IA filtra contenido no deseado en X con 'Bouncer'

Un nuevo plugin para navegador llamado 'Bouncer' está permitiendo a los usuarios filtrar contenido no deseado de su feed de X (anteriormente Twitter) utilizando inteligencia artificial. Disponible en la Chrome Web Store, Bouncer permite a los usuarios definir temas de filtro en lenguaje natural, com