VectorWare lleva el SIMD portable de Rust a la GPU por primera vez

VectorWare, compañía que se presenta como la primera empresa de software nativa para GPU, anunció que logró ejecutar el SIMD portable de Rust (core::simd) sobre la GPU, un hito sin precedentes para la programación de procesadores gráficos en este lenguaje. La empresa, especializada en tooling para l

Radsort: algoritmo de ordenación paralelo con sobrecarga espacial mínima

El artículo académico 'Parallel O(√n) Overhead LSD Radix Sort', presentado por Robert Clausecker en julio de 2026, introduce Radsort, una variante optimizada del algoritmo de ordenación radix de menor a mayor (LSD). Esta técnica está diseñada para resolver la limitación de memoria de los métodos tra

mold: un enlazador masivamente paralelo para compilar binarios en segundos

mold es un enlazador (linker) para sistemas Unix y Linux que aplica paralelismo de datos de forma sistemática a todo el proceso de enlazado, una fase crítica en la construcción de software que combina ficheros objeto compilados para producir un ejecutable o una biblioteca compartida. Aunque los enla

Se acabó el almuerzo gratis: el giro hacia la concurrencia en el software

Herb Sutter describe en este artículo de fondo, publicado originalmente en Dr. Dobb's Journal en 2005 y actualizado en 2009, el cambio más importante en el desarrollo de software desde la revolución orientada a objetos: el fin de las mejoras gratuitas de rendimiento y el giro forzoso hacia la concur

VectorWare logra ejecutar Rust SIMD sobre la GPU

VectorWare ha anunciado que su toolchain permite ejecutar código Rust escrito con la API portable de SIMD (core::simd) directamente sobre la GPU, sin requerir anotaciones específicas de GPU en el código fuente. La compañía describe la técnica como una novedad sin precedentes que aprovecha el modelo

Richard Feynman y la Connection Machine: crónica de un verano prodigioso

W. Daniel Hillis, cofundador de la Long Now Foundation, reconstruye en Physics Today el verano que Richard Feynman pasó en Thinking Machines Corporation, la empresa que el propio Hillis acababa de fundar para construir un ordenador paralelo con un millón de procesadores, la Connection Machine. Feynm

Domina la programación CUDA con los mejores libros del mercado

Esta lista curada reúne los mejores libros de programación CUDA, la plataforma de NVIDIA para computación paralela en GPUs. CUDA permite aprovechar la enorme capacidad de procesamiento paralelo de las tarjetas gráficas para tareas de alto rendimiento que antes requerían clusters costosos. La colecci

Blender simula el cosmos: física y arte se unen

Este artículo, escrito por MohammadHossein Jamshidi (un estudiante de doctorado en Física/Cosmología y también ingeniero de animación con experiencia en la industria de los videojuegos), explora el uso innovador de Nodos de Geometría en Blender para aplicaciones cosmológicas. El objetivo principal e

Cálculos dispersos: nuevo método optimiza el rendimiento

El cálculo eficiente con datos dispersos (sparse data) es crucial en muchas áreas científicas y de ingeniería, desde simulaciones físicas hasta aprendizaje automático. Sin embargo, optimizar el código para estas operaciones, especialmente en hardware diverso como diferentes GPUs, puede ser extremada

ia: la lentitud de la generación de texto es un desafío

El campo de la inteligencia artificial, particularmente en modelos de lenguaje grandes (LLMs) como ChatGPT, se enfrenta a un desafío: la generación de texto es inherentemente lenta. El proceso de 'decodificación autoregresiva', que es la forma tradicional en que estos modelos generan texto, implica

Nueva técnica acelera cálculos complejos con GPUs

El artículo de Bee Rosa Davis presenta una innovadora técnica llamada 'Curvature-Guided Wavefront Execution' (Ejecución de Frente de Onda Guiada por Curvatura) que revoluciona la resolución de problemas de satisfacción de restricciones (CSP) utilizando la potencia de las GPUs. En esencia, se trata d