Optimización de caché n-gram en llama.cpp acelera la decodificación

Un desarrollador ha implementado optimizaciones en llama.cpp que aceleran la decodificación mediante búsqueda de prompts (prompt lookup decoding) hasta 42 veces más rápido y reducen el uso de memoria hasta 2,6 veces. Esta mejora se basa en técnicas de optimización de rendimiento inspiradas en el tra

Análisis técnico: cómo AMD Ryzen aumentó su velocidad un 50% en dos años

El análisis técnico de Daniel Lemire revela que los procesadores AMD Ryzen 7 de 2022 a 2024, específicamente los modelos 5800X3D, 7800X3D y 9800X3D, experimentaron un aumento del 50% en su rendimiento según las pruebas de Geekbench 6. Este incremento se atribuye a la transición de la arquitectura Ze

Los números flotantes subnormales son lentos en procesadores Intel

Los números de punto flotante subnormales, definidos por el estándar IEEE para valores muy pequeños, presentan un coste de rendimiento significativo en procesadores Intel. Un análisis técnico realizado por Daniel Lemire demuestra que estas operaciones pueden ralentizar las computaciones hasta 45 vec

La nueva API JSON de Go: ¿hasta el doble de rápida o 1,5 veces más lenta?

Go 1.27 incorpora por defecto el nuevo paquete encoding/json/v2 en su biblioteca estándar, con una API prácticamente idéntica a la del paquete original encoding/json, aunque no se trata de un reemplazo directo: difiere en aspectos como la validación Unicode y la sensibilidad a mayúsculas y minúscula

Cómo parsear direcciones IPv4 en C# a gran velocidad con AVX-512

El investigador Daniel Lemire presenta una rutina en C# capaz de parsear direcciones IPv4 —como 192.168.0.1— unas tres veces más rápido que la función IPAddress.TryParse incluida en la biblioteca estándar de .NET. La clave está en aprovechar las instrucciones SIMD AVX-512, disponibles en procesadore

El precio de las memorias borra dos décadas de abaratar el PC

El desarrollador y científico Daniel Lemire ha publicado en GitHub gráficos que muestran cómo el precio de las memorias para PC ha regresado a niveles de 2007, lo que considera una reversión de veinte años de progreso en abaratar el hardware. La memoria RAM ha subido un 400 % en un año, sin señales

Cuánto ayudan los niveles de microarquitectura amd64 en Go

Recompilar código Go con niveles de microarquitectura más altos puede recortar hasta un 43% el tiempo de ejecución en operaciones intensivas, sin tocar una sola línea de código fuente, según un análisis publicado por el investigador Daniel Lemire, profesor de la Universidad de Quebec y reconocido ex

Solo el 17% de los enteros de 64 bits son productos de dos enteros de 32 bits

Daniel Lemire, científico de la computación, ha revelado que solo el 17% de todos los enteros sin signo de 64 bits pueden expresarse como el producto de dos enteros de 32 bits. Este hallazgo, respaldado por el trabajo matemático de Webster y sus colegas, aborda una preocupación práctica en el diseño

IA mejora código ensamblador y acelera rendimiento

Investigadores han demostrado que la inteligencia artificial (IA), específicamente modelos como Grok y Claude, pueden optimizar código en lenguaje ensamblador, logrando mejoras significativas en el rendimiento. Daniel Lemire, investigador, llevó a cabo un experimento donde solicitó a estas IA que op

ARM Neon: cálculo más rápido con nueva técnica

Un nuevo método para calcular sumas de prefijos (prefix sums) en procesadores ARM Neon ha logrado velocidades de hasta 8.9 mil millones de valores por segundo en un Apple M4, superando significativamente el enfoque tradicional (3.9 mil millones de valores por segundo). La técnica, desarrollada por D

URLs con saltos de línea: un secreto de los navegadores

Navegadores web modernos, sorprendentemente, toleran la inclusión de saltos de línea y tabulaciones dentro de las URLs, según un análisis reciente publicado en el blog de Daniel Lemire. Aunque la especificación técnica de URLs indica que estos caracteres deberían generar un error, los navegadores lo