Claude Fable 5.1: novedades y cambios
Claude Fable 5.1 es el nuevo modelo de Anthropic para agentes de larga duración. Explicamos sus novedades, precio, diferencias y compatibilidad.
¿Qué es Claude Fable 5.1? Es el modelo más reciente de Anthropic para programación agéntica de larga duración, investigación en varios pasos y trabajo con documentos. Esta guía explica sus novedades frente a Fable 5, si merece la pena actualizar y cuánto cuesta usar la API.
La conclusión corta: Fable 5.1 es una actualización relevante para los flujos más difíciles y prolongados, sobre todo cuando reutilizan un prefijo grande en caché. No es la opción automática para programar a diario; Anthropic recomienda empezar la mayoría de cargas con Opus 5 y pasar a Fable cuando las evaluaciones lo justifiquen.
Datos comprobados el 4 de septiembre de 2026. La fecha de lanzamiento, las especificaciones, los precios y la migración proceden de la documentación actual de Anthropic. No ejecutamos un benchmark independiente controlado, por lo que las mejoras se atribuyen a Anthropic. OmniaKey ya incluye claude-fable-5-1; su precio de gateway se mantiene por separado en el catálogo en vivo.
¿Qué es Claude Fable 5.1?
Claude Fable 5.1 es un modelo especializado para tareas que duran más que un turno de chat: programación con varios archivos, investigaciones largas, búsquedas con seguimiento y flujos de documentos, hojas de cálculo o presentaciones. Ofrece contexto de 1M de tokens, hasta 128K tokens de salida y adaptive thinking siempre activo.
| Resumen | Claude Fable 5.1 |
|---|---|
| Fecha de lanzamiento | 1 de septiembre de 2026 |
| Mejor para | Agentes exigentes de larga duración, investigación y trabajo del conocimiento |
| Model ID de la API | claude-fable-5-1 |
| Contexto / salida máxima | 1M / 128K tokens |
| Thinking | Adaptive y siempre activo; effort predeterminado high |
| Corte de conocimiento | Junio de 2026 |
| Precio base de Anthropic | $10 entrada / $0.25 cache read / $50 salida por MTok |
Es el sucesor de Claude Fable 5, no un producto distinto de Claude Code. La API de Anthropic y las nubes asociadas usan el ID exacto claude-fable-5-1; OmniaKey también ofrece esa ruta y publica su precio actual en el catálogo en vivo.
Este es un análisis informativo, no una promesa de ganar todos los benchmarks. Anthropic comunica mejoras en programación prolongada, investigación, visión, uso del ordenador y documentos de oficina; el resultado independiente depende del agente, las herramientas, los permisos, el prompt y la prueba de aceptación.
¿Qué novedades trae Claude Fable 5.1?
Los cambios que conviene conocer primero son:
- la entrada, las escrituras de caché y la salida mantienen el precio, pero la lectura de caché baja;
- Anthropic describe mejoras en programación agéntica larga, investigación, visión y computer use;
- se añaden cambios de
effortpor mensaje y mensajessystemlimitados a un turno (beta); - se pueden mostrar actualizaciones legibles entre llamadas de herramientas (beta);
- el texto generado y algunos medios incorporan procedencia de contenido.
También hay tres riesgos de migración: forzar la selección de una herramienta puede devolver 400, los modelos Claude anteriores no leen los thinking blocks de Fable 5.1 y editar el prefijo de la conversación puede invalidar los bloques posteriores. Para un cliente propio de Messages API, esto importa más que el nombre de la versión.
Precio de Claude Fable 5.1 API
Todas las cifras son USD por un millón de tokens (MTok).
| Tipo de uso | Tarifa estándar Anthropic | Qué significa |
|---|---|---|
| Entrada sin caché | $10.00 | Prompt, historial, archivos y herramientas nuevos |
| Escritura de caché 5m | $12.50 | Guardar un prefijo elegible durante cinco minutos |
| Escritura de caché 1h | $20.00 | Guardar un prefijo elegible durante una hora |
| Lectura de caché | $0.25 | Prefijo que el proveedor registró como cache hit |
| Salida | $50.00 | Respuesta visible y tokens de razonamiento facturados como salida |
La entrada, las escrituras de caché y la salida cuestan lo mismo que en Fable 5. El cambio material es la lectura de caché: $0.25/MTok en lugar de $1.00/MTok. Por eso no son modelos completamente iguales en precio, aunque coincidan las líneas principales de entrada y salida.
La estimación completa es:
cost = uncached_input_millions × 10.00
+ cache_write_5m_millions × 12.50
+ cache_write_1h_millions × 20.00
+ cache_read_millions × 0.25
+ output_millions × 50.00
Las herramientas de pago, impuestos, reintentos, regiones y reglas del gateway pueden añadir otras líneas. Cuadra el gasto con los campos de uso reales, no solo con la longitud de la respuesta visible.
Claude Fable 5.1 frente a Fable 5: diferencias prácticas
El número de versión no implica una rebaja general. Fable 5.1 cambia la lectura de caché y el comportamiento de la API, pero no reduce la entrada ni la salida base.
| Elemento | Claude Fable 5 | Claude Fable 5.1 | Impacto de migración |
|---|---|---|---|
| Entrada base | $10/MTok | $10/MTok | Sin cambio |
| Escritura de caché 5m | $12.50/MTok | $12.50/MTok | Sin cambio |
| Escritura de caché 1h | $20/MTok | $20/MTok | Sin cambio |
| Lectura de caché | $1/MTok | $0.25/MTok | El contexto repetido cuesta menos |
| Salida | $50/MTok | $50/MTok | Sin cambio |
| Ventana de contexto | 1M | 1M | Misma capacidad |
| Salida máxima | 128K | 128K | Misma capacidad |
tool_choice forzado | auto, none, any o tool nombrado | Solo auto o none | any y tool nombrado devuelven 400 |
| Dirección de thinking blocks | Genera blocks anteriores | Lee blocks antiguos; modelos anteriores no leen los de 5.1 | Un downgrade puede descartar razonamiento |
| Effort durante la conversación | Cambiar la petición puede perder caché | Cambio por mensaje (beta) | Los turnos difíciles y rutinarios pueden variar effort |
| Actualizaciones de progreso | Comportamiento de Fable 5 | Updates legibles disponibles (beta) | La interfaz muestra estado sin raw reasoning |
| Procedencia del contenido | Comportamiento anterior | Watermark estadístico y C2PA en algunos medios | No requiere cambiar la petición |
Si el flujo casi nunca repite un prefijo grande, el ahorro será pequeño. Si repite instrucciones del sistema, esquemas de herramientas y documentos estables, la diferencia puede reducir el coste de varias llamadas.
Claude Fable 5.1 vs Opus 5: ¿cuál elegir?
Para la mayoría de tareas complejas de programación y razonamiento, empieza con Claude Opus 5. Anthropic publica $5 de entrada y $25 de salida por MTok, la mitad de las tarifas base de Fable 5.1, por lo que permite comprobar antes si el nivel especialista es realmente necesario.
Prueba Fable 5.1 cuando Opus 5 con un effort adecuado no supere la aceptación, el trabajo deba mantener coherencia durante horas o el agente relea un gran prefijo en muchos turnos. Compara tasa de éxito, reintentos, latencia y corrección humana, no solo el número de versión.
Tres ejemplos de coste
Los ejemplos usan solo las categorías publicadas y excluyen herramientas, impuestos, reintentos y cargos específicos del gateway.
Ejemplo 1: primera investigación sin caché
Supón un millón de tokens de entrada sin caché y 100,000 tokens de salida:
1 × $10.00 + 0.1 × $50.00 = $15.00
La ventana 1M permite enviar mucho contexto, pero no lo convierte en una asignación gratuita.
Ejemplo 2: prefijo de cinco minutos
Supón 100,000 tokens escritos en la caché 5m, 500,000 lecturas posteriores y 20,000 tokens de salida:
0.1 × $12.50 + 0.5 × $0.25 + 0.02 × $50.00 = $2.375
La escritura se cobra antes de la primera lectura. La cuenta solo vale cuando el proveedor informa cada bucket correctamente.
Ejemplo 3: prefijo de una hora
Supón un millón de tokens escritos en la caché 1h, ocho millones leídos después y 500,000 tokens de salida:
1 × $20.00 + 8 × $0.25 + 0.5 × $50.00 = $47.00
En este caso domina la salida. El adaptive thinking puede aumentar los tokens de salida aunque la respuesta visible sea corta.
Cuándo compensa el prompt caching
Fable 5.1 conserva los multiplicadores de escritura de Fable 5:
- una escritura 5m equivale a 1.25x el precio de entrada;
- una escritura 1h equivale a 2x el precio de entrada;
- una lectura de caché de Fable 5.1 equivale a 0.025x el precio de entrada;
- el prompt mínimo cacheable es de 512 tokens.
Para un prefijo repetido, una escritura 5m suele recuperar su coste después de la primera lectura. Una escritura 1h normalmente necesita dos lecturas para superar el envío sin caché. Es un punto de equilibrio aritmético, no una garantía de cache hit.
Coloca instrucciones del sistema, definiciones de herramientas y referencias grandes y estables en el prefijo. Deja los detalles variables al final. Un prompt parecido no es automáticamente un cache hit; comprueba cache_read_input_tokens y cache_creation_input_tokens.
ID de modelo y acceso a la API
Fija el ID exacto para que las pruebas sean reproducibles:
| Plataforma | ID de modelo |
|---|---|
| Anthropic API | claude-fable-5-1 |
| Amazon Bedrock | anthropic.claude-fable-5-1 |
| Google Cloud | claude-fable-5-1 |
| Microsoft Foundry | claude-fable-5-1 |
| Claude Platform on AWS | claude-fable-5-1 |
El alias fable de Claude Code puede apuntar al último modelo cuando la cuenta y el proveedor lo permiten. Para una comparación estable, registra claude-fable-5-1.
OmniaKey ya ofrece claude-fable-5-1 con su propio catálogo y frontera de facturación. Revisa el precio actual en el catálogo en vivo, crea una clave limitada en API tokens y sigue la guía de inicio rápido de la API.
Después de confirmar la ruta, una petición compatible con Anthropic tiene este formato:
curl https://api.omniakey.com/v1/messages \
-H "x-api-key: $OMNIAKEY_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "claude-fable-5-1",
"max_tokens": 1024,
"messages": [{"role": "user", "content": "Encuentra el supuesto de mayor riesgo en este plan de migración."}]
}'
Si el ID desaparece temporalmente del descubrimiento, detén la petición y revisa el estado del servicio. El gateway debe devolver un error, no sustituir el modelo en silencio.
Migrar desde Fable 5
1. Cambia el ID
model = "claude-fable-5" # antes
model = "claude-fable-5-1" # después
Mantén el ID en configuración y guárdalo junto con cada resultado de evaluación.
2. Mantén adaptive thinking
Fable 5.1 usa adaptive thinking de forma permanente. {"type":"disabled"} y {"type":"enabled","budget_tokens":16000} devuelven HTTP 400. Omite thinking o usa {"type":"adaptive"} si el cliente lo admite. Controla el coste midiendo effort y max_tokens con las mismas pruebas de aceptación.
3. No fuerces la herramienta
Los valores any y la herramienta con nombre en tool_choice devuelven 400. Conserva auto, explica la acción en la instrucción y usa esquemas estrictos o structured outputs para controlar el resultado.
{
"tool_choice": {"type": "auto"},
"tools": [{
"name": "record_summary",
"strict": true,
"input_schema": {
"type": "object",
"properties": {"summary": {"type": "string"}},
"required": ["summary"],
"additionalProperties": false
}
}]
}
4. Conserva la historia y los thinking blocks
Cambiar un turno anterior, system, tools, una imagen o un documento puede invalidar un thinking block posterior y producir un error 400. Mantén el historial de forma incremental, usa server-side compaction o comienza una conversación nueva sin bloques antiguos.
5. Revisa la versión del cliente
La ruta compatible de OmniaKey usa una identidad de Claude Code igual o superior a 2.1.251. Si el selector no muestra Fable 5.1 o el rechazo ocurre antes del proveedor, actualiza el cliente y revisa el base URL. Actualizar el cliente no concede por sí solo acceso de organización a Anthropic.
Errores habituales de Fable 5.1
tool_choice devuelve HTTP 400
Elimina any y la selección por nombre, deja auto y expresa la obligación en la instrucción.
thinking devuelve HTTP 400
Elimina enabled y disabled. Fable 5.1 es adaptive-only; baja effort o el alcance de la tarea si necesitas controlar el presupuesto.
Invalid signature o bloque incompatible
Restaura exactamente system, tools y el prefijo de mensajes, o inicia un diálogo nuevo. No repitas indefinidamente el mismo body inválido.
Unknown model
Usa claude-fable-5-1, no el nombre visible ni un alias antiguo. En OmniaKey comprueba primero el catálogo y el base URL.
La factura supera la respuesta visible
Revisa entrada sin caché, ambas escrituras, lecturas, output de thinking, herramientas, reintentos, impuestos y multiplicadores de ruta.
¿Merece la pena actualizar a Claude Fable 5.1?
La actualización merece una prueba cuando la tarea es larga, ambigua, intensiva en herramientas o cara de reparar tras un desvío. El menor precio de lectura de caché ayuda si reutilizas un prefijo estable durante muchos turnos. No es automáticamente el mejor modelo para programar a diario: la entrada y la salida siguen al nivel de Fable 5. Consulta la página del modelo Claude Fable 5.1 para la ruta actual y la página de Fable 5 para comparar la versión anterior. Para trabajo normal, compara primero con Claude Opus 5 o Sonnet.
La guía amplia de selección de Claude Code está en esta guía de modelos. El análisis del modelo anterior está en la guía de precio de Fable 5, y la comparación entre proveedores en Fable 5 frente a GPT-5.6 Sol.
Compara el coste de una tarea aceptada, no solo el precio por token:
accepted-task cost = successful-run charges
+ failed retries
+ human correction time
+ remediation risk
Usa el mismo commit, prompt, herramientas, permisos, esfuerzo y comandos de aceptación. El nombre del modelo no es un benchmark.
Preguntas frecuentes
¿Qué es Claude Fable 5.1?
Claude Fable 5.1 es el modelo más reciente de Anthropic para programación agéntica de larga duración, investigación y conocimiento aplicado. Tiene contexto de 1M, salida máxima de 128K y adaptive thinking siempre activo.
¿Qué cambia respecto a Claude Fable 5?
La entrada, las escrituras de caché y la salida no cambian, pero la lectura baja a $0.25/MTok. También llegan controles beta de effort y progreso, mientras que la selección forzada de herramientas y algunos cambios del historial pueden devolver 400.
¿Cuánto cuesta Claude Fable 5.1?
Anthropic publica $10.00 de entrada, $12.50 por escritura 5m, $20.00 por escritura 1h, $0.25 por lectura y $50.00 de salida por millón de tokens. La tarifa de OmniaKey se muestra aparte en el catálogo en vivo.
¿Fable 5.1 es más barato que Fable 5?
No en todo. Entrada, escrituras y salida no cambian; la lectura baja de $1/MTok a $0.25/MTok. El coste final depende de la mezcla de tokens, herramientas y reintentos.
¿Se puede desactivar el thinking?
No. Adaptive thinking siempre está activo. Usa effort y un max_tokens medido.
¿Puedo usar Fable 5.1 en Claude Code?
Sí, cuando el proveedor activo lo ofrece y el cliente admite el modelo. La ruta compatible de OmniaKey requiere una identidad de Claude Code de al menos 2.1.251.
¿Es adecuado para zero-data-retention?
Confirma la política del proveedor y de la ruta exacta. Las condiciones de retención de Fable 5.1 pueden ser distintas; no envíes código sensible sin esa confirmación.
Fuentes comprobadas
- Anthropic: descripción de Claude Fable 5.1
- Anthropic: novedades de Fable 5.1
- Anthropic: migración a Fable 5.1
- Precios de la API de Anthropic
- Configuración de modelos de Claude Code
- Catálogo de modelos de OmniaKey
- Inicio rápido de la API de OmniaKey
Verificado el 4 de septiembre de 2026. Las tarifas, la disponibilidad, la caché, la retención y las reglas del gateway pueden cambiar. Revisa las fuentes primarias y el catálogo en vivo antes de usar tráfico o presupuesto de producción.