Noticias que mencionan FlashAttention

Las universidades, ante la IA: prefieren no adaptarse

La autora, académica y antigua gestora universitaria, sostiene que la educación superior está perdiendo el tren de la inteligencia artificial. Cuatro años después de la irrupción de ChatGPT, las universidades siguen enfrascadas en debates sobre atletismo, diversidad ideológica o financiación federal

Flash-MSA: kernels de atención dispersa para entrenar con un millón de tokens

Flash-MSA es el primer conjunto de kernels de código abierto que permite entrenar de forma eficiente modelos con MiniMax Sparse Attention (MSA), un mecanismo de atención dispersa inspirado en DeepSeek Sparse Attention que varios modelos frontera —DeepSeek V3.2, DeepSeek V4-Pro, GLM-5.2, LongCat-2.0

Jmaczan lanza tiny-vllm, motor educativo de inferencia LLM

El desarrollador Jmaczan ha lanzado en GitHub 'tiny-vllm', un motor de inferencia de alto rendimiento para modelos de lenguaje grande (LLM) desarrollado en C++ y CUDA. Esta iniciativa se presenta como una versión más compacta y educativa de vLLM, diseñada para derivar desde cero las matemáticas y ar