Slotstream ejecuta un modelo de 104 GB en Mac mediante SSD

Slotstream es una herramienta experimental para ejecutar Qwen3.8-Flash-Next en equipos Mac con mucha menos memoria de la que ocupa el modelo. El original, cuantizado a 4 bits, pesa 103,8 GB y se divide en 24 archivos. En lugar de cargarlo por completo, la aplicación almacena en memoria una selección

Qwen Scribe: transcripción local y dictado en macOS con Apple Silicon

Qwen Scribe es una aplicación de código abierto que ofrece transcripción de audio y vídeo y dictado en todo el sistema ejecutándose por completo en un Mac con Apple Silicon, sin cuentas, claves de API ni servicios en la nube. El proyecto se encuentra en la versión 0.1.0-beta.1 y utiliza el modelo Qw

Neutrino-1 8B: un único archivo de 3,88 GB para GPU, Mac y CPU

Neutrino-1 8B: un único archivo de 3,88 GB para GPU, Mac y CPU La startup Fermion Research ha presentado Neutrino-1 8B, un modelo de inteligencia artificial de 8.000 millones de parámetros que destaca por una característica singular: se distribuye como un único archivo de 3,88 gigabytes capaz de ej

Nativ: ejecuta modelos de IA abiertos en local sobre Apple Silicon

Nativ es una aplicación de escritorio para macOS que permite ejecutar modelos de inteligencia artificial de código abierto —de Google, Cohere y Liquid AI, entre otros— directamente en Macs con chip Apple Silicon (M1 y posteriores), sin cuentas, suscripciones ni dependencia de la nube. La herramienta

Ejecutar Claude Code sin conexión: ajustes y hardware

Claude Code, la herramienta de codificación asistida por inteligencia artificial de Anthropic, puede ejecutarse en un entorno completamente local y aislado (air-gapped) sin necesidad de conexión a internet. El artículo describe la configuración necesaria para lograrlo, utilizando un modelo local com

Google lanza versiones QAT de Gemma 4 para móviles y portátiles

Google ha presentado nuevos checkpoints de Gemma 4 optimizados con Quantization-Aware Training (QAT), una técnica que integra la cuantización durante el entrenamiento para reducir la pérdida de calidad al comprimir los modelos. La novedad permite ejecutar Gemma 4 en dispositivos móviles y GPUs de co

Magenta RealTime 2: el modelo abierto de música en vivo para MacBook

El equipo Magenta de Google presenta Magenta RealTime 2 (MRT2), un modelo de música generativa de código abierto y un motor de inferencia en tiempo real que permite construir y tocar instrumentos musicales con IA directamente desde un portátil con chip Apple Silicon. A diferencia de otros modelos g

Gemma 4 en Mac Mini: Ejecuta IA localmente

Usuarios de Mac Mini con chips Apple Silicon (M1, M2, M3, M4 o M5) ahora pueden ejecutar el modelo de lenguaje Gemma 4 26B localmente gracias a una guía publicada en GitHub. El proceso, relativamente sencillo, implica la instalación de la aplicación Ollama a través de Homebrew, que gestiona las actu

SwiftLM: LLMs nativos y rápidos en Apple Silicon

Un equipo de desarrolladores ha lanzado SwiftLM, un servidor de inferencia nativo para dispositivos Apple Silicon que ofrece compatibilidad con la API de OpenAI. Esta herramienta, de código abierto, elimina la necesidad de un entorno de ejecución de Python y el Global Interpreter Lock (GIL), lo que

Ollama optimiza IA en Apple Silicon con MLX

Ollama ha anunciado una versión preliminar que optimiza significativamente el rendimiento de sus modelos de lenguaje en dispositivos Apple Silicon. La actualización, disponible desde el 30 de marzo de 2026, integra el framework de aprendizaje automático MLX de Apple, aprovechando su arquitectura de