Frugon: un analizador de costes LLM local y de código abierto

Fuentes: Frugon: a local, open-source LLM cost analyzer for your machine

Frugon es una herramienta de código abierto, gratuita y de uso local que permite a desarrolladores y equipos identificar dónde se está gastando de más en sus llamadas a modelos de lenguaje de gran tamaño (LLM). Funciona leyendo ficheros JSONL con el formato de petición y respuesta de OpenAI y calcula, en la propia máquina del usuario, cuánto se podría ahorrar redirigiendo parte del tráfico a modelos más baratos sin perder calidad.

La herramienta ofrece tres funciones principales. En primer lugar, un módulo de captura local (frugon capture) que actúa como proxy HTTP entre la aplicación del usuario y el proveedor: reenvía las llamadas sin alterarlas y guarda un registro JSONL por cada petición, sin añadir latencia ni enviar datos a servidores externos. En segundo lugar, un analizador de costes (frugon analyze) que procesa los registros, contabiliza tokens y aplica precios locales para mostrar el gasto actual. En tercer lugar, una función opcional de medición de calidad (--measure) que, usando las claves API del propio usuario, muestrea llamadas reales contra modelos candidatos para validar que la calidad se mantiene.

El resultado incluye una recomendación de enrutamiento concreta: qué porcentaje de llamadas sencillas puede desviarse a un modelo más económico y cuáles conviene mantener en el modelo actual, junto con el ahorro mensual estimado. Por ejemplo, sobre una muestra de 56.100 llamadas con GPT-5.5 como línea base, Frugon propone mover el 64,4 % a DeepSeek-V4-Flash, con un ahorro del 37,4 % al mes (unos 205 dólares). También puede generar un informe HTML o Markdown compartible. Toda la ejecución es local, las claves API van siempre al proveedor del usuario y la herramienta ignora proxies HTTP ambientales para evitar filtraciones.