Noticias que mencionan AVX-512

BITCOS rompe la barrera de 1.58 bits por peso en LLMs ternarios

Un nuevo estudio publicado en arXiv presenta BITCOS, una técnica de almacenamiento adaptativa a la distribución que permite a los Modelos de Lenguaje Grandes (LLM) ternarios superar el límite teórico de 1.58 bits por peso. A diferencia del formato estándar de empaquetado de cinco pesos ternarios por

Algoritmo Quicksort vectorizado portable para bases de datos columnares

Un nuevo algoritmo de Quicksort vectorizado permite acelerar el ordenamiento de datos en bases de datos columnares mediante instrucciones SIMD portables. A diferencia de las implementaciones anteriores, esta solución es compatible con seis conjuntos de instrucciones en tres arquitecturas, incluyendo

Stockfish 19 incorpora binarios universales y gana hasta 44 puntos Elo

El proyecto Stockfish ha presentado la versión 19 de su motor de ajedrez open source, disponible de forma gratuita en su web oficial y compatible con cualquier interfaz gráfica. Frente a Stockfish 18, la nueva versión mejora el rendimiento hasta 44 puntos Elo y multiplica por más de tres los emparej

Cómo parsear direcciones IPv4 en C# a gran velocidad con AVX-512

El investigador Daniel Lemire presenta una rutina en C# capaz de parsear direcciones IPv4 —como 192.168.0.1— unas tres veces más rápido que la función IPAddress.TryParse incluida en la biblioteca estándar de .NET. La clave está en aprovechar las instrucciones SIMD AVX-512, disponibles en procesadore

Visión general de las plantillas de ensamblador en línea

El lenguaje Odin incorpora un sistema de plantillas de ensamblador en línea (inline asm) diseñado como entidades llamables que se instancian en el lugar de cada llamada, comportándose como intrínsecos. Por ahora, la implementación solo cubre objetivos amd64 (windows_amd64, linux_amd64 y darwin_amd64

SIMD en los años 90: programar el Intel Pentium MMX

En 1997 Intel presentó las extensiones MMX (MultiMedia eXtensions) junto al procesador Pentium MMX, un conjunto de 57 instrucciones adicionales pensadas para acelerar gráficos, procesamiento de audio, vídeo y software de módem. MMX no inventó el modelo SIMD (Single Instruction, Multiple Data), pero

Cómo afecta la alineación de memoria al rendimiento SIMD

La alineación de los accesos a memoria influye de forma directa en el rendimiento de cualquier forma de vectorización SIMD, ya sea automática o explícita. Un acceso se considera alineado cuando su dirección es múltiplo del tamaño del acceso (por ejemplo, 64 bytes para un vector de 16 enteros de 4 by

Decodificación zigzag con AVX-512: dos optimizaciones SIMD

Este artículo técnico explora dos optimizaciones SIMD para la decodificación de enteros codificados en formato zigzag, descubiertas durante el trabajo del autor en la decodificación de vértices con AVX-512 en la biblioteca meshoptimizer. El zigzag es una técnica que mapea enteros con signo a valores

Cuánto ayudan los niveles de microarquitectura amd64 en Go

Recompilar código Go con niveles de microarquitectura más altos puede recortar hasta un 43% el tiempo de ejecución en operaciones intensivas, sin tocar una sola línea de código fuente, según un análisis publicado por el investigador Daniel Lemire, profesor de la Universidad de Quebec y reconocido ex

Geekbench 6: ¿nueva referencia para medir rendimiento?

Este artículo de Chips and Cheese evalúa Geekbench 6, una suite de benchmarks diseñada para pruebas de rendimiento en sistemas modernos, comparándola con el estándar de la industria SPEC CPU2017. Geekbench, a diferencia de SPEC CPU2017 que se distribuye en código fuente, se entrega en formato binari