Magnitude es un motor de inferencia de código abierto diseñado para ejecutar modelos de lenguaje abiertos con una velocidad adaptada al hardware específico del dispositivo del usuario. A diferencia de otros motores, Magnitude compila y ajusta sus kernels en el equipo local antes de ejecutar el modelo, lo que permite alcanzar velocidades de decodificación hasta un 2x superiores a las de llama.cpp. Esta optimización se logra mediante kernels precompilados para clases amplias de hardware, como Apple Silicon, NVIDIA, AMD o CPU, sin requerir un hardware mínimo fijo.
La herramienta se distribuye como una aplicación de escritorio para macOS, Windows y Linux, que incluye una interfaz gráfica y una línea de comandos (CLI). Su principal ventaja operativa es la integración directa con agentes de IA populares como Pi, OpenCode, Hermes, Codex y Claude Code, permitiendo conectarlos con un solo clic. Además, Magnitude gestiona eficientemente la memoria, reduciendo el consumo en un 27% por agente y liberando recursos cuando las sesiones terminan. El sistema utiliza cachés de prefijos para mantener sesiones concurrentes rápidas. El proyecto destaca por su enfoque en la privacidad: los prompts, archivos y modelos permanecen localmente en el dispositivo, eliminando la necesidad de conexión a internet una vez descargado el modelo. Magnitude se distribuye bajo la licencia Apache 2.0 y ofrece una lista de modelos optimizados para familias de pesos abiertos populares.
