Anthropic ha presentado Claude Fable 5.1, su modelo más avanzado hasta la fecha, que en la evaluación independiente de Artificial Analysis alcanza 66 puntos, por delante de los 63 de Opus 5 y los 61 de GPT-5.6, Soly y Grok 4.6. El lanzamiento llega acompañado de cambios técnicos importantes, una estrategia de doble modelo y un replanteamiento de precios que, según el uso, puede traducirse en ahorros o en costes más elevados.
Fable 5.1 llega junto a Claude Mythos 5.1, una versión reservada a los participantes del llamado Project Glasswing —organizaciones y socios de confianza— con capacidades especialmente sensibles en el ámbito de la ciberseguridad. Según la documentación oficial de Anthropic, ambos modelos comparten el mismo núcleo técnico y especificaciones, pero ofrecen distintos niveles de salvaguardas. La compañía describe esta práctica como una forma de gestionar la tensión creciente entre capacidad y seguridad, en un momento en el que la propia empresa reconoció haber detenido entrenamientos por episodios de reward hacking en los que la IA aprendía a hacer trampas para maximizar sus recompensas.
En términos de rendimiento, las mejoras son sensibles en programación, investigación científica y tareas agénticas prolongadas. Alex Albert, de Anthropic, ha destacado en redes sociales que Fable 5.1 puede completar por sí solo lo que falta cuando se le dan unas pocas frases vagas y desordenadas, una capacidad clave para los agentes, que así necesitan menos instrucciones intermedias. Ethan Mollick, con acceso anticipado, ha subrayado que la mejora más clara se aprecia en trabajos largos que requieren "juicio y gusto": la idea de que un modelo puede trabajar durante horas decidiendo qué merece la pena hacer, cuándo una solución es suficientemente buena o cuándo conviene cambiar de estrategia. La prueba del pelícano SVG de Simon Willison fue superada con éxito al precio de 3,3 dólares y un esfuerzo de razonamiento máximo.
Sin embargo, la propia evaluación de Artificial Analysis incorpora letra pequeña. El benchmark se realizó con el sistema de fallback de Anthropic —presente ya en Fable 5—, que desvía las consultas consideradas peligrosas a un modelo menos capaz (Opus 4.8 en este caso). El 4% de los tokens de salida del Intelligence Index procedieron de ese modo seguro, lo que sugiere que el resultado real podría haber sido incluso mayor. Además, Fable 5.1 siempre piensa antes de responder, lo que tiene implicaciones directas para los desarrolladores.
En el apartado de precios, Anthropic mantiene la tarifa base de Fable 5: 10 dólares por millón de tokens de entrada y 50 por millón de salida, pero reduce un 75% el coste de las lecturas de caché, que pasan de 1 dólar a 0,75 dólares por millón de tokens. La compañía asegura que esto se traduce en ahorros del 25% en cargas habituales y de hasta el 45% en trabajos agénticos, debido a la reutilización constante del contexto. Sin embargo, Artificial Analysis ha detectado que el coste medio por tarea con razonamiento al nivel "Max" alcanza los 3,76 dólares, un 20% más que en Fable 5, porque el modelo genera 1,7 veces más tokens de salida al pensar y escribir mucho más. Es decir, más barato por token, pero no necesariamente por tarea.
Para los desarrolladores, la actualización trae tres cambios incompatibles con Fable 5 que conviene tener en cuenta. Primero, el forzador de tool use deja de funcionar: cualquier intento de establecer tool_choice a {"type": "any"} o {"type": "tool", "name": "..."} devuelve un error 400 invalid_request_error, ya que el modelo siempre piensa antes de actuar y volcaba su razonamiento en los argumentos de la herramienta, degradando su calidad. Solo se mantienen tool_choice en modo "auto" (por defecto) o "none". Anthropic recomienda, para obtener JSON válido contra esquema, usar strict: true en el tool use o migrar a structured outputs. Segundo, los bloques de pensamiento están vinculados al modelo que los produjo: un modelo anterior no puede leer los de Fable 5.1. Tercero, editar turnos anteriores invalida los bloques de pensamiento posteriores. A esto se suman cinco cambios aditivos: un parámetro de esfuerzo por mensaje (beta), mensajes de sistema scoped por turno (beta), actualizaciones legibles entre llamadas a herramientas (display: "updates", beta), el nuevo precio de lectura de caché ya mencionado y un sistema de procedencia de contenido.
Anthropic recomienda empezar con Claude Opus 5 para la mayoría de cargas y reservar Fable 5.1 para razonamiento exigente y trabajo agéntico de largo horizonte, o cuando las evaluaciones sobre Opus 5 a mayor esfuerzo se queden cortas. El panorama, en definitiva, muestra a una compañía que sigue empujando los límites de capacidad mientras refuerza la diferenciación entre versiones públicas y restringidas, en un contexto de creciente escrutinio sobre la seguridad de los modelos frontera.
