Ramp Router es un enrutador de modelos de lenguaje (LLM) que la fintech Ramp ha abierto al público tras más de dos años usándolo internamente para más de 100 casos de uso. Funciona como un único punto de acceso compatible con la API de OpenAI que dirige cada petición al modelo más adecuado según calidad, coste y disponibilidad. En producción, la herramienta enruta más de 2,75 billones de tokens al mes, presume de una reducción de costes de aproximadamente el 30% con apenas 30 milisegundos de latencia añadida y una tasa de éxito de enrutamiento del 99,999%.
El router selecciona el modelo apropiado para cada tarea — desde extracción estructurada en facturas hasta generación de SQL, traducción o moderación de contenido — y aplica más de 100 optimizaciones automáticas, como caché, compactación y atribución semántica, para abaratar cada solicitud. Cada semana evalúa los nuevos modelos que aparecen en el mercado y los incorpora cuando cumplen un umbral de calidad. Si un proveedor sufre una caída, redirige las peticiones a otro modelo disponible como respaldo. Entre los modelos soportados se incluyen versiones recientes de OpenAI, Anthropic y Gemini, además de modelos abiertos seleccionados como Kimi.
El servicio es gratuito en su lanzamiento: el usuario paga el precio de lista de los tokens consumidos, y los 500 primeros clientes del acceso anticipado recibirán 100 dólares en créditos promocionales. No requiere disponer de una tarjeta ni de cuenta corporativa de Ramp, tan solo apuntarse a la lista de espera. Su propuesta de valor frente a usar directamente a un proveedor es evitar quedar atado a un único catálogo y una única estructura de precios.
