Noticias que mencionan Metal

Wax: IA más fácil con nueva gestión de memoria

Un nuevo conjunto de herramientas llamado 'Wax' simplifica la gestión de la memoria para aplicaciones de inteligencia artificial, ofreciendo una alternativa radical a las complejas arquitecturas tradicionales de Retrieval-Augmented Generation (RAG). Desarrollado por Christopherkarani y disponible en

Minecraft Java: mejora de gráficos con Vulkan

Mojang, la empresa desarrolladora de Minecraft, anunció el 18 de febrero la transición de su versión Java del motor de renderizado de OpenGL a Vulkan como parte de la próxima actualización 'Vibrant Visuals'. Este cambio significativo busca mejorar el rendimiento y aprovechar las características más

Mapean minas de EE.UU.: herramienta gratuita revela datos clave

Un nuevo y gratuito recurso en línea, mines.fyi, ha mapeado todas las minas activas y abandonadas en Estados Unidos, ofreciendo una base de datos exhaustiva y accesible al público. La herramienta, desarrollada por un equipo de ingenieros y programadores, proporciona información detallada sobre cada

Attyx: Terminal determinista y rápido gracias a la GPU

Un nuevo emulador de terminal llamado 'Attyx' ha sido desarrollado por Semos Labs y se presenta como una alternativa determinista y acelerada por GPU. Construido completamente en Zig, Attyx se distingue por su enfoque en la corrección y claridad, priorizando pruebas exhaustivas en modo sin cabeza. S

C++ acelera reconocimiento de voz con modelo Parakeet

Un equipo de desarrolladores ha creado una implementación en C++ de los modelos de reconocimiento de voz Parakeet de Nvidia, ofreciendo una mejora significativa en la velocidad para su ejecución en dispositivos. El proyecto, alojado en GitHub, utiliza la biblioteca de tensores ligera axiom, que incl

CPU innovadora opera dentro de una GPU

Investigadores han desarrollado una CPU innovadora que opera completamente dentro de una GPU, eliminando la necesidad de interacción con la CPU principal del sistema. Este prototipo, denominado NeuralCPU, ejecuta instrucciones ARM64 reales y utiliza tensores de PyTorch para almacenar registros, memo

macOS: asistente de voz IA funciona sin internet

RunanywhereAI ha lanzado RCLI, un asistente de voz con inteligencia artificial diseñado para macOS que funciona completamente en el dispositivo, eliminando la necesidad de conexión a la nube o claves de API. Utilizando Apple Silicon (M1 o posterior), RCLI integra reconocimiento de voz (STT), un mode

Karaoke IA: Nightingale mejora tu experiencia cantando

Nightingale, una nueva aplicación de karaoke, ha lanzado una versión innovadora que utiliza inteligencia artificial para ofrecer una experiencia de canto mejorada. Disponible para Linux, macOS y Windows, la aplicación separa las voces de la instrumentación de las canciones utilizando modelos como UV

macOS: ejecuta apps de Linux sin emuladores

Usuarios de macOS ahora pueden ejecutar aplicaciones de Linux de forma nativa gracias a Cocoa-Way, un nuevo compositor Wayland desarrollado por J-x-Z. La herramienta, disponible desde GitHub, elimina la necesidad de máquinas virtuales o emuladores, ofreciendo una integración transparente de aplicaci

SwiftLM: LLMs nativos y rápidos en Apple Silicon

Un equipo de desarrolladores ha lanzado SwiftLM, un servidor de inferencia nativo para dispositivos Apple Silicon que ofrece compatibilidad con la API de OpenAI. Esta herramienta, de código abierto, elimina la necesidad de un entorno de ejecución de Python y el Global Interpreter Lock (GIL), lo que

TQ4_1S: LLMs más pequeños para dispositivos Apple

Un desarrollador ha presentado una nueva técnica de compresión de modelos de lenguaje grandes (LLM) llamada TQ4_1S, diseñada específicamente para dispositivos Apple con chips Metal. Esta técnica reduce el tamaño de los modelos en un 27-38%, dependiendo del modelo, sin necesidad de reentrenamiento ni

Agente IA optimiza código, mejora rendimiento en IA

Un agente de codificación ha logrado optimizar el código de Flash Attention en llama.cpp en un 15% para x86 y un 5% para ARM, gracias a la incorporación de una fase de investigación previa a la codificación. El equipo de SkyPilot, utilizando la herramienta autoresearch (y su versión generalizada, pi

Apple Silicon: GPU y WebAssembly comparten memoria

Apple ha habilitado una innovadora técnica de inferencia de GPU sin copia en sus chips Silicon, permitiendo que los módulos WebAssembly (Wasm) compartan directamente su memoria lineal con la GPU. Tradicionalmente, la comunicación entre Wasm y la GPU implicaba costosas copias de datos a través de un

DeepSeek v4 Flash: Motor de inferencia más rápido y eficiente

Un equipo de ingenieros, liderado por Antirez, ha lanzado DeepSeek v4 Flash, un nuevo motor de inferencia optimizado para el modelo de lenguaje DeepSeek V4 Flash. Este motor, denominado 'ds4.c', está diseñado específicamente para este modelo y no es un framework genérico. La principal ventaja radica

Swift alcanza Teraflops entrenando LLMs en Apple Silicon

Este artículo explora cómo optimizar operaciones de multiplicación de matrices en Swift para entrenar Large Language Models (LLMs) en Apple Silicon, buscando alcanzar rendimiento de Teraflop/s desde el punto de partida de Gigaflops. El autor, Matt Gallagher, toma como referencia la implementación ll

Domina la reconstrucción 3D con Gaussian Splatting este fin de semana

3D Gaussian Splatting (3DGS) es una técnica innovadora de reconstrucción tridimensional que permite crear modelos 3D a partir de un conjunto de fotografías de una escena tomada desde múltiples ángulos de cámara. A diferencia de los renderizadores tradicionales que utilizan triángulos como primitivas

avoxelgame: un voxel game experimental escrito en Dyalog APL y SDL3

avoxelgame es un proyecto de código abierto en el que el autor, namgyaaal, se propuso demostrar que la notación de APL permite construir un juego de vóxeles de forma más sencilla. El resultado, reconoce, es un título altamente experimental e inestable, pero ofrece una base jugable: el usuario se des

OpenCL y sus alternativas: lecciones de la democratización fallida

El artículo, quinta entrega de la serie "Democratizing AI Compute", escrito por Chris Lattner (cofundador de Modular), analiza por qué OpenCL y otros modelos de programación de GPU portátiles (como SYCL, oneAPI) fracasaron en convertirse en plataformas dominantes para la inteligencia artificial, a p

Tutorial de Vulkan: introducción a la API de gráficos y cómputo

Vulkan es una API de gráficos y cómputo desarrollada por el grupo Khronos, la misma organización detrás de OpenGL. Ofrece una abstracción mucho más explícita del hardware gráfico moderno que sus predecesoras, lo que se traduce en un mejor rendimiento y en un comportamiento del controlador más predec

transcribe.cpp: nueva biblioteca de transcripción local basada en ggml

transcribe.cpp es una biblioteca de transcripción de voz a texto basada en ggml, presentada por el autor y mantenedor de Handy como un proyecto de código abierto en su versión 0.1.0. Su objetivo es simplificar la distribución de aplicaciones de reconocimiento automático del habla (ASR) multiplatafor

Qué aprender para ser programador de gráficos en tiempo real

Esta guía didáctica, escrita por un programador veterano de gráficos, detalla las habilidades necesarias para incorporarse al mercado laboral como desarrollador de gráficos en tiempo real, un campo clave de la industria del videojuego y del renderizado. El autor parte de una advertencia sobre el pap

Nativ: ejecuta modelos de IA abiertos en local sobre Apple Silicon

Nativ es una aplicación de escritorio para macOS que permite ejecutar modelos de inteligencia artificial de código abierto —de Google, Cohere y Liquid AI, entre otros— directamente en Macs con chip Apple Silicon (M1 y posteriores), sin cuentas, suscripciones ni dependencia de la nube. La herramienta

Jaithon: un lenguaje dinámico con máquina virtual y compilador propio

Jaithon es un lenguaje de programación dinámico con recolección de basura y una máquina virtual de bytecode. Combina la arquitectura de Java con la sintaxis inspirada en Rust, Python y JavaScript, y todo su código está escrito mayoritariamente en sí mismo (es bootstrapped), lo que facilita añadir nu

Renderizado de un toro 3D en el terminal mediante el protocolo gráfico Kitty

Andrea presenta la versión 0.5 de 'torus', un programa que renderiza un toro tridimensional directamente en la terminal. Para conseguirlo, utiliza el protocolo gráfico Kitty, compatible con terminales como Ghostty, que permite mostrar imágenes mediante secuencias de escape específicas. La imagen deb

h3.c: motor nativo de inferencia MiniMax H3 para Apple Silicon

h3.c es un motor de inferencia nativo para el modelo de generación de vídeo MiniMax-H3, desarrollado específicamente para equipos Mac con chip Apple Silicon (procesadores M3 Max y M5 Max). El proyecto se construye mediante rebanadas verticales funcionales: primero metadatos deterministas del modelo

Cua libera un shim que acelera Metal en VMs macOS sobre Apple Silicon

Cua, el equipo detrás de la pila de virtualización Lume para macOS, ha publicado como 'research release' una pequeña capa de compatibilidad, limitada a un proceso, que desbloquea rutas modernas de Metal dentro de una máquina virtual macOS invitada ejecutada sobre Apple Virtualization.framework. La c

Optimizar Automatic1111 en Apple Silicon con kernels Metal a medida

Un desarrollador detalla cómo aceleró Automatic1111 en Macs con chip M1 y M3 Pro manteniendo intacta la interfaz, los checkpoints, las LoRAs, los samplers y la API originales. El punto de partida fue la comparación con Draw Things: una generación corta de cinco pasos con DPM++ SDE Karras y CFG cerca

NEO Emacs: reescritura en Rust y renderizado por GPU

NEO Emacs es una reescritura moderna del editor de texto Emacs, diseñada para la próxima generación de desarrolladores mediante una arquitectura en Rust y un motor de renderizado basado en GPU. El proyecto busca eliminar las limitaciones históricas del núcleo C original, ofreciendo seguridad de memo

MCDMA conecta Mac Studio y DGX Spark mediante RDMA nativo

MCDMA es un proyecto de código abierto que permite conectar un Mac Studio y una NVIDIA DGX Spark mediante un camino de memoria directa, utilizando el stack RDMA nativo de macOS. El objetivo es unificar el procesamiento de modelos de lenguaje, aprovechando la capacidad de prellenado de la GPU Blackwe