Lumabri es un motor escrito en C puro, sin dependencias, que permite ejecutar modelos de mezcla de expertos (MoE) de gran tamaño distribuyendo el trabajo entre múltiples máquinas conectadas en un enjambre (swarm). Su principio fundacional es que cualquier equipo puede unirse, tenga o no GPU: el software fue diseñado primero para CPU y SSD, y una GPU solo lo acelera sin alterar el resultado, que es byte a byte idéntico en ambos casos. Un equipo con el modelo lo comparte mediante ./lumabri serve --model /ruta, y cualquier otro se conecta con ./lumabri chat --tracker IP:7300, sin descargas previas: los bytes necesarios para una inferencia llegan del par en el primer uso y se conservan en un espejo local, de modo que la segunda consulta se sirve desde disco a velocidad local. El binario del motor permanece inalterado. Entre sus características destaca un menú interactivo inicial que permite elegir entre solo chatear, donar espacio en disco, donar cómputo o ambas cosas, con asignación automática de los archivos menos replicados para reforzar la disponibilidad. Soporta NAT sin configuración de router mediante retransmisión a través del tracker, enjambres privados con token (LUMABRI_TOKEN=S) y firma criptográfica del origen de los archivos. Dispone de comandos en el chat como /swarm, que muestra la red en vivo de forma anónima, y /model, que lista y cambia entre modelos incluso de arquitecturas distintas (GLM, OLMoE, DeepSeek). El proyecto incluye un modelo sintético diminuto (tiny_olmoe) generado con Python y NumPy para probar todo el flujo sin descargar pesos, y una suite make test que verifica la identidad de bytes incluso en la ruta de retransmisión.
