Llama.app, el hogar oficial de llama.cpp para ejecutar IA en local

Fuentes: llama.app — the official home for llama.cpp, local AI on your machine

Llama.app se presenta como la página oficial del proyecto de código abierto llama.cpp, una iniciativa pensada para ejecutar modelos de inteligencia artificial de frontera directamente en el ordenador del usuario, sin depender de servicios en la nube, claves de API ni telemetría. Toda la información y los datos de las conversaciones permanecen en el equipo local, lo que sitúa a la herramienta en la órbita del software de IA privado y autoalojado.

La instalación se realiza con un único comando (curl) y, a partir de ahí, el usuario puede arrancar un servidor de modelos con 'llama serve' y combinarlo con agentes de codificación locales, como el plugin pi-llama para Pi, que detecta automáticamente el modelo disponible sin necesidad de configuración adicional.

Uno de los puntos clave del proyecto es su portabilidad: el mismo binario y los mismos modelos funcionan desde un portátil hasta un clúster, con kernels optimizados a mano para CPU y GPU en distintas arquitecturas. La página destaca además modelos compatibles, entre ellos Qwen 3.6 de Alibaba, Gemma 4 y Gemma 3 de Google y GPT-OSS, los primeros modelos de pesos abiertos de OpenAI desde GPT-2, orientados al razonamiento, los flujos agénticos y el uso por desarrolladores.