El temporizador de cache keepalive de los agentes cuesta 8 veces más de lo necesario
Mantener caliente la caché de prompts en flujos agénticos es una práctica extendida pero casi siempre mal calibrada. Un análisis experimental con cuatro proveedores (Anthropic, OpenAI, DeepSeek y Gemini) demuestra que el intervalo habitual de 30 segundos cuesta unas ocho veces más de lo necesario, y
