Tokenless es un enrutador de modelos de lenguaje presentado como sustituto directo de las llamadas a las API de OpenAI y Anthropic. Su propuesta consiste en enviar cada petición a varios modelos en paralelo, supervisar sus respuestas en tiempo real y cancelar los que no llevan ventaja, de modo que el usuario paga únicamente por el resultado del modelo que se ajusta a sus necesidades. La compañía afirma que el sistema alcanza la misma calidad que los modelos frontera a una fracción del coste.
Según los benchmarks internos publicados, el nivel PRO resuelve el 72% de las tareas con un coste de 0,32 dólares por tarea, un 57% menos que la alternativa más barata comparada. En TerminalBench 2.1, el nivel MAX alcanza un 82% de aciertos frente al 72% de Opus 4.8, aunque a un coste superior. En LiveCodeBench, las diferencias se estrechan: PRO logra un 89%, GPT 5.5 un 85,7%, Opus 4.8 un 88,9% y MAX un 90,4%, con un coste total de 74,78 dólares para PRO frente a 80,01 dólares de Opus 4.8.
El servicio expone un punto de conexión compatible con las APIs existentes, lo que permite migrar cambiando dos líneas de código. La herramienta está desarrollada por investigadores procedentes de Google DeepMind, Princeton y UC Berkeley, y cuenta con el respaldo de Y Combinator. Quienes necesiten priorizar la calidad máxima sobre el ahorro pueden optar por MAX, que encamina cada tarea al mejor modelo disponible. La empresa invita a solicitar una demo para estimar el ahorro sobre el tráfico real de cada cliente.
