Noticias que mencionan FP8

Nvidia cambia estrategia: ¿más potencia FP64 en GeForce?

Nvidia está reevaluando el rendimiento de doble precisión (FP64) en sus GPUs, marcando un cambio significativo en su estrategia de segmentación de mercado. Durante más de 15 años, la compañía ha reducido deliberadamente el rendimiento FP64 en sus GPUs de consumo (GeForce) en comparación con sus GPUs

Unsloth Studio: IA fácil con su interfaz sin código

Unsloth AI ha lanzado Unsloth Studio (Beta), una interfaz de usuario web de código abierto y sin necesidad de programación para entrenar, ejecutar y exportar modelos de IA de código abierto localmente. La herramienta, disponible para Windows, Linux, WSL y MacOS (con soporte limitado para entrenamien

FP4: Nuevo formato de punto flotante optimiza eficiencia

El artículo explora el formato de punto flotante de 4 bits (FP4), una alternativa de baja precisión a los formatos de punto flotante tradicionales de 32 y 64 bits. Originalmente, los números de punto flotante se almacenaban en 32 bits, luego evolucionaron a 64 bits para aumentar la precisión. Sin e

T-Head publica un fork de Triton con backend para sus procesadores PPU

El repositorio t-head/triton-for-sail es un fork del compilador y lenguaje Triton que añade un backend específico para los procesadores PPU desarrollados por T-Head Semiconductor, utilizados en su SDK SAIL. Está pensado para dos generaciones de Tensor Core: PPU0010, con instrucciones MMAv1, y PPU001

INT8 ConvRot: el formato de cuantización que haría innecesario el FP8

INT8 ConvRot es un nuevo método de modelado y cuantización para modelos de IA que llega integrado de forma nativa en ComfyUI a partir de la versión 0.27.0, publicada el 1 de julio de 2026. Se perfila como el nuevo estándar para los modelos cuantizados a 8 bits y está sustituyendo en la práctica a lo

Guía para desplegar DeepSeek V4 Flash en producción sobre una AMD MI300X

El repositorio ryanzhou/deepseek-v4-flash-mi300x reúne la configuración y los parches necesarios para ejecutar el modelo DeepSeek-V4-Flash-0731 (304B parámetros) en producción sobre una única GPU AMD Instinct MI300X. La MI300X dispone de 192 GiB de HBM3 y un ancho de banda de 5,3 TB/s, lo que permit

Qwen publica en open source los pesos cuantizados FP8 de Qwen3.8-2.4T-A95B

El repositorio Qwen/Qwen3.8-2.4T-A95B-FP8 en Hugging Face distribuye los pesos cuantizados en FP8 de un modelo MoE de 2,4 billones de parámetros con 95.000 millones activos, pensado para ejecutarse en vLLM, SGLang, TokenSpeed o mediante Docker. El cuantificado utiliza granularidad fina con bloques d

DLSS 5 reduce hasta un 97% el rendimiento en la GeForce RTX 3080

La filtración de los archivos binarios de DLSS 5 ha permitido a modders activar esta tecnología en juegos y en tarjetas gráficas sin soporte nativo, como las GeForce RTX 40 y RTX 30, lo que ha servido para medir su impacto real en rendimiento. Las primeras pruebas indican una pérdida aproximada del