BITCOS rompe la barrera de 1.58 bits por peso en LLMs ternarios

Un nuevo estudio publicado en arXiv presenta BITCOS, una técnica de almacenamiento adaptativa a la distribución que permite a los Modelos de Lenguaje Grandes (LLM) ternarios superar el límite teórico de 1.58 bits por peso. A diferencia del formato estándar de empaquetado de cinco pesos ternarios por

Algoritmo Quicksort vectorizado portable para bases de datos columnares

Un nuevo algoritmo de Quicksort vectorizado permite acelerar el ordenamiento de datos en bases de datos columnares mediante instrucciones SIMD portables. A diferencia de las implementaciones anteriores, esta solución es compatible con seis conjuntos de instrucciones en tres arquitecturas, incluyendo

Cómo parsear direcciones IPv4 en C# a gran velocidad con AVX-512

El investigador Daniel Lemire presenta una rutina en C# capaz de parsear direcciones IPv4 —como 192.168.0.1— unas tres veces más rápido que la función IPAddress.TryParse incluida en la biblioteca estándar de .NET. La clave está en aprovechar las instrucciones SIMD AVX-512, disponibles en procesadore

Cómo afecta la alineación de memoria al rendimiento SIMD

La alineación de los accesos a memoria influye de forma directa en el rendimiento de cualquier forma de vectorización SIMD, ya sea automática o explícita. Un acceso se considera alineado cuando su dirección es múltiplo del tamaño del acceso (por ejemplo, 64 bytes para un vector de 16 enteros de 4 by

Todos los programadores deberían conocer SIMD

SIMD, siglas de Single Instruction, Multiple Data, es una técnica de la CPU que permite ejecutar una misma operación sobre múltiples datos en paralelo: en lugar de comparar un byte por ciclo, el procesador puede comparar 4, 8 o más bytes con una sola instrucción. Aunque goza de fama de compleja y re

Decodificación zigzag con AVX-512: dos optimizaciones SIMD

Este artículo técnico explora dos optimizaciones SIMD para la decodificación de enteros codificados en formato zigzag, descubiertas durante el trabajo del autor en la decodificación de vértices con AVX-512 en la biblioteca meshoptimizer. El zigzag es una técnica que mapea enteros con signo a valores

Cuánto ayudan los niveles de microarquitectura amd64 en Go

Recompilar código Go con niveles de microarquitectura más altos puede recortar hasta un 43% el tiempo de ejecución en operaciones intensivas, sin tocar una sola línea de código fuente, según un análisis publicado por el investigador Daniel Lemire, profesor de la Universidad de Quebec y reconocido ex