Claude Fable 5.1: novedades, cambios incompatibles y precios

Anthropic ha presentado Claude Fable 5.1, su modelo más avanzado hasta la fecha, que en la evaluación independiente de Artificial Analysis alcanza 66 puntos, por delante de los 63 de Opus 5 y los 61 de GPT-5.6, Soly y Grok 4.6. El lanzamiento llega acompañado de cambios técnicos importantes, una est

Codex CLI sobre Bedrock carece de control de caché explícita para GPT-5.6 Sol

El proyecto Codex CLI de OpenAI, al integrarse de forma nativa con Amazon Bedrock mediante el endpoint Bedrock Mantle Responses API, no permite activar el mecanismo de caché de prompts explícito del modelo GPT-5.6 Sol. Esa ausencia impide reutilizar el prefijo estable de instrucciones y definiciones

Cómo funciona la compactación de contexto en el agente de codificación Pi

Los modelos de lenguaje grandes tienen ventanas de contexto limitadas, lo que significa que en sesiones largas de programación con agentes como Pi, Claude Code o Codex la conversación acaba superando la capacidad del modelo y este rechaza la petición. Para evitar perder todo el progreso, el equipo d

CostPerPrompt: precios en vivo y calculadoras de coste para APIs de IA

CostPerPrompt es una herramienta web que recopila y actualiza de forma automática los precios de más de 232 modelos de lenguaje y de imagen, y los convierte en estimaciones concretas de gasto mensual para chatbots, agentes, sistemas RAG, voz y cargas de trabajo por API. La página ofrece calculadoras

Por qué Manifest retiró su enrutador de LLM tras meses de pruebas

La empresa Manifest ha detallado los motivos que la llevaron a desactivar en junio y cerrar definitivamente el 1 de septiembre su enrutador de modelos de lenguaje, una función que había lanzado en marzo dentro de su pasarela LLM. El sistema clasificaba cada petición en cuatro niveles de complejidad

Una crítica técnica a OpenCode: fallos de caché y diseño del prompt

Un análisis extenso y crítico del agente de programación OpenCode, la herramienta de código abierto de este tipo más popular en GitHub con 161.000 estrellas. El autor distingue entre problemas molestos —fallos repetidos de caché de prompt al reevaluar el prompt del sistema en cada turno SSE, al poda

claude-thermos: un proxy local para mantener caliente la caché de Claude Code

claude-thermos es una herramienta de línea de comandos que envuelve a Claude Code en un proxy local inverso para evitar el coste oculto de la pérdida de caché de prompts. Cuando un agente principal queda bloqueado a la espera de un subagente durante más de cinco minutos, la caché de su historial de

El keepalive del caché en flujos agentic cuesta 8 veces más de lo necesario

Artículo técnico que desmonta la convención habitual de hacer ping al caché de prompts cada 30 segundos y demuestra, con mediciones reales, que ese intervalo es entre 6 y 8 veces más caro de lo necesario. El autor probó el comportamiento del keepalive en cuatro proveedores principales —Anthropic, Op

Claude Code gasta 4,7 veces más tokens que OpenCode antes de leer tu prompt

Una comparativa técnica controlada entre los asistentes de programación Claude Code y OpenCode, ambos ejecutados sobre claude-sonnet-4-5, revela diferencias abismales en el consumo de tokens. En una tarea mínima que pedía una respuesta de una sola línea, Claude Code inyectó alrededor de 33.000 token

Comprar cachés KV para eliminar el prefill redundante en agentes de IA

Un nuevo artículo académico propone una solución radical para uno de los problemas más ineficientes de la inteligencia artificial actual: el prefill redundante. Cada vez que un agente de IA procesa un documento, ejecuta desde cero la fase de prefill, la etapa computacionalmente más costosa de un mod

Claude Code Pro Max: Usuarios Denuncian Agotamiento Rápido de Cuota

Usuarios de la versión Pro Max 5x (Opus) de Claude Code están reportando un agotamiento inesperado de su cuota de uso en tan solo 1.5 horas, a pesar de un uso moderado. El problema, según la investigación, radica en que los tokens de 'cache_read' se están contabilizando a la misma tasa que los token