DeepSeek V4 Flash ya está disponible · Nuestro precio de GLM-5.2 baja al 50% del oficial
Blog
Guía

Claude Fable 5.1: novedades y cambios

Claude Fable 5.1 es el nuevo modelo de Anthropic para agentes de larga duración. Explicamos sus novedades, precio, diferencias y compatibilidad.

13 min de lecturaOmniaKey
Claude Fable 5.1model reviewwhat's newAPI pricingClaude Code

¿Qué es Claude Fable 5.1? Es el modelo más reciente de Anthropic para programación agéntica de larga duración, investigación en varios pasos y trabajo con documentos. Esta guía explica sus novedades frente a Fable 5, si merece la pena actualizar y cuánto cuesta usar la API.

La conclusión corta: Fable 5.1 es una actualización relevante para los flujos más difíciles y prolongados, sobre todo cuando reutilizan un prefijo grande en caché. No es la opción automática para programar a diario; Anthropic recomienda empezar la mayoría de cargas con Opus 5 y pasar a Fable cuando las evaluaciones lo justifiquen.

Datos comprobados el 4 de septiembre de 2026. La fecha de lanzamiento, las especificaciones, los precios y la migración proceden de la documentación actual de Anthropic. No ejecutamos un benchmark independiente controlado, por lo que las mejoras se atribuyen a Anthropic. OmniaKey ya incluye claude-fable-5-1; su precio de gateway se mantiene por separado en el catálogo en vivo.

¿Qué es Claude Fable 5.1?

Claude Fable 5.1 es un modelo especializado para tareas que duran más que un turno de chat: programación con varios archivos, investigaciones largas, búsquedas con seguimiento y flujos de documentos, hojas de cálculo o presentaciones. Ofrece contexto de 1M de tokens, hasta 128K tokens de salida y adaptive thinking siempre activo.

ResumenClaude Fable 5.1
Fecha de lanzamiento1 de septiembre de 2026
Mejor paraAgentes exigentes de larga duración, investigación y trabajo del conocimiento
Model ID de la APIclaude-fable-5-1
Contexto / salida máxima1M / 128K tokens
ThinkingAdaptive y siempre activo; effort predeterminado high
Corte de conocimientoJunio de 2026
Precio base de Anthropic$10 entrada / $0.25 cache read / $50 salida por MTok

Es el sucesor de Claude Fable 5, no un producto distinto de Claude Code. La API de Anthropic y las nubes asociadas usan el ID exacto claude-fable-5-1; OmniaKey también ofrece esa ruta y publica su precio actual en el catálogo en vivo.

Este es un análisis informativo, no una promesa de ganar todos los benchmarks. Anthropic comunica mejoras en programación prolongada, investigación, visión, uso del ordenador y documentos de oficina; el resultado independiente depende del agente, las herramientas, los permisos, el prompt y la prueba de aceptación.

¿Qué novedades trae Claude Fable 5.1?

Los cambios que conviene conocer primero son:

  • la entrada, las escrituras de caché y la salida mantienen el precio, pero la lectura de caché baja;
  • Anthropic describe mejoras en programación agéntica larga, investigación, visión y computer use;
  • se añaden cambios de effort por mensaje y mensajes system limitados a un turno (beta);
  • se pueden mostrar actualizaciones legibles entre llamadas de herramientas (beta);
  • el texto generado y algunos medios incorporan procedencia de contenido.

También hay tres riesgos de migración: forzar la selección de una herramienta puede devolver 400, los modelos Claude anteriores no leen los thinking blocks de Fable 5.1 y editar el prefijo de la conversación puede invalidar los bloques posteriores. Para un cliente propio de Messages API, esto importa más que el nombre de la versión.

Precio de Claude Fable 5.1 API

Todas las cifras son USD por un millón de tokens (MTok).

Tipo de usoTarifa estándar AnthropicQué significa
Entrada sin caché$10.00Prompt, historial, archivos y herramientas nuevos
Escritura de caché 5m$12.50Guardar un prefijo elegible durante cinco minutos
Escritura de caché 1h$20.00Guardar un prefijo elegible durante una hora
Lectura de caché$0.25Prefijo que el proveedor registró como cache hit
Salida$50.00Respuesta visible y tokens de razonamiento facturados como salida

La entrada, las escrituras de caché y la salida cuestan lo mismo que en Fable 5. El cambio material es la lectura de caché: $0.25/MTok en lugar de $1.00/MTok. Por eso no son modelos completamente iguales en precio, aunque coincidan las líneas principales de entrada y salida.

La estimación completa es:

text
cost = uncached_input_millions × 10.00
     + cache_write_5m_millions × 12.50
     + cache_write_1h_millions × 20.00
     + cache_read_millions × 0.25
     + output_millions × 50.00

Las herramientas de pago, impuestos, reintentos, regiones y reglas del gateway pueden añadir otras líneas. Cuadra el gasto con los campos de uso reales, no solo con la longitud de la respuesta visible.

Claude Fable 5.1 frente a Fable 5: diferencias prácticas

El número de versión no implica una rebaja general. Fable 5.1 cambia la lectura de caché y el comportamiento de la API, pero no reduce la entrada ni la salida base.

ElementoClaude Fable 5Claude Fable 5.1Impacto de migración
Entrada base$10/MTok$10/MTokSin cambio
Escritura de caché 5m$12.50/MTok$12.50/MTokSin cambio
Escritura de caché 1h$20/MTok$20/MTokSin cambio
Lectura de caché$1/MTok$0.25/MTokEl contexto repetido cuesta menos
Salida$50/MTok$50/MTokSin cambio
Ventana de contexto1M1MMisma capacidad
Salida máxima128K128KMisma capacidad
tool_choice forzadoauto, none, any o tool nombradoSolo auto o noneany y tool nombrado devuelven 400
Dirección de thinking blocksGenera blocks anterioresLee blocks antiguos; modelos anteriores no leen los de 5.1Un downgrade puede descartar razonamiento
Effort durante la conversaciónCambiar la petición puede perder cachéCambio por mensaje (beta)Los turnos difíciles y rutinarios pueden variar effort
Actualizaciones de progresoComportamiento de Fable 5Updates legibles disponibles (beta)La interfaz muestra estado sin raw reasoning
Procedencia del contenidoComportamiento anteriorWatermark estadístico y C2PA en algunos mediosNo requiere cambiar la petición

Si el flujo casi nunca repite un prefijo grande, el ahorro será pequeño. Si repite instrucciones del sistema, esquemas de herramientas y documentos estables, la diferencia puede reducir el coste de varias llamadas.

Claude Fable 5.1 vs Opus 5: ¿cuál elegir?

Para la mayoría de tareas complejas de programación y razonamiento, empieza con Claude Opus 5. Anthropic publica $5 de entrada y $25 de salida por MTok, la mitad de las tarifas base de Fable 5.1, por lo que permite comprobar antes si el nivel especialista es realmente necesario.

Prueba Fable 5.1 cuando Opus 5 con un effort adecuado no supere la aceptación, el trabajo deba mantener coherencia durante horas o el agente relea un gran prefijo en muchos turnos. Compara tasa de éxito, reintentos, latencia y corrección humana, no solo el número de versión.

Tres ejemplos de coste

Los ejemplos usan solo las categorías publicadas y excluyen herramientas, impuestos, reintentos y cargos específicos del gateway.

Ejemplo 1: primera investigación sin caché

Supón un millón de tokens de entrada sin caché y 100,000 tokens de salida:

text
1 × $10.00 + 0.1 × $50.00 = $15.00

La ventana 1M permite enviar mucho contexto, pero no lo convierte en una asignación gratuita.

Ejemplo 2: prefijo de cinco minutos

Supón 100,000 tokens escritos en la caché 5m, 500,000 lecturas posteriores y 20,000 tokens de salida:

text
0.1 × $12.50 + 0.5 × $0.25 + 0.02 × $50.00 = $2.375

La escritura se cobra antes de la primera lectura. La cuenta solo vale cuando el proveedor informa cada bucket correctamente.

Ejemplo 3: prefijo de una hora

Supón un millón de tokens escritos en la caché 1h, ocho millones leídos después y 500,000 tokens de salida:

text
1 × $20.00 + 8 × $0.25 + 0.5 × $50.00 = $47.00

En este caso domina la salida. El adaptive thinking puede aumentar los tokens de salida aunque la respuesta visible sea corta.

Cuándo compensa el prompt caching

Fable 5.1 conserva los multiplicadores de escritura de Fable 5:

  • una escritura 5m equivale a 1.25x el precio de entrada;
  • una escritura 1h equivale a 2x el precio de entrada;
  • una lectura de caché de Fable 5.1 equivale a 0.025x el precio de entrada;
  • el prompt mínimo cacheable es de 512 tokens.

Para un prefijo repetido, una escritura 5m suele recuperar su coste después de la primera lectura. Una escritura 1h normalmente necesita dos lecturas para superar el envío sin caché. Es un punto de equilibrio aritmético, no una garantía de cache hit.

Coloca instrucciones del sistema, definiciones de herramientas y referencias grandes y estables en el prefijo. Deja los detalles variables al final. Un prompt parecido no es automáticamente un cache hit; comprueba cache_read_input_tokens y cache_creation_input_tokens.

ID de modelo y acceso a la API

Fija el ID exacto para que las pruebas sean reproducibles:

PlataformaID de modelo
Anthropic APIclaude-fable-5-1
Amazon Bedrockanthropic.claude-fable-5-1
Google Cloudclaude-fable-5-1
Microsoft Foundryclaude-fable-5-1
Claude Platform on AWSclaude-fable-5-1

El alias fable de Claude Code puede apuntar al último modelo cuando la cuenta y el proveedor lo permiten. Para una comparación estable, registra claude-fable-5-1.

OmniaKey ya ofrece claude-fable-5-1 con su propio catálogo y frontera de facturación. Revisa el precio actual en el catálogo en vivo, crea una clave limitada en API tokens y sigue la guía de inicio rápido de la API.

Después de confirmar la ruta, una petición compatible con Anthropic tiene este formato:

bash
curl https://api.omniakey.com/v1/messages \
  -H "x-api-key: $OMNIAKEY_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-fable-5-1",
    "max_tokens": 1024,
    "messages": [{"role": "user", "content": "Encuentra el supuesto de mayor riesgo en este plan de migración."}]
  }'

Si el ID desaparece temporalmente del descubrimiento, detén la petición y revisa el estado del servicio. El gateway debe devolver un error, no sustituir el modelo en silencio.

Migrar desde Fable 5

1. Cambia el ID

python
model = "claude-fable-5"    # antes
model = "claude-fable-5-1"  # después

Mantén el ID en configuración y guárdalo junto con cada resultado de evaluación.

2. Mantén adaptive thinking

Fable 5.1 usa adaptive thinking de forma permanente. {"type":"disabled"} y {"type":"enabled","budget_tokens":16000} devuelven HTTP 400. Omite thinking o usa {"type":"adaptive"} si el cliente lo admite. Controla el coste midiendo effort y max_tokens con las mismas pruebas de aceptación.

3. No fuerces la herramienta

Los valores any y la herramienta con nombre en tool_choice devuelven 400. Conserva auto, explica la acción en la instrucción y usa esquemas estrictos o structured outputs para controlar el resultado.

json
{
  "tool_choice": {"type": "auto"},
  "tools": [{
    "name": "record_summary",
    "strict": true,
    "input_schema": {
      "type": "object",
      "properties": {"summary": {"type": "string"}},
      "required": ["summary"],
      "additionalProperties": false
    }
  }]
}

4. Conserva la historia y los thinking blocks

Cambiar un turno anterior, system, tools, una imagen o un documento puede invalidar un thinking block posterior y producir un error 400. Mantén el historial de forma incremental, usa server-side compaction o comienza una conversación nueva sin bloques antiguos.

5. Revisa la versión del cliente

La ruta compatible de OmniaKey usa una identidad de Claude Code igual o superior a 2.1.251. Si el selector no muestra Fable 5.1 o el rechazo ocurre antes del proveedor, actualiza el cliente y revisa el base URL. Actualizar el cliente no concede por sí solo acceso de organización a Anthropic.

Errores habituales de Fable 5.1

tool_choice devuelve HTTP 400

Elimina any y la selección por nombre, deja auto y expresa la obligación en la instrucción.

thinking devuelve HTTP 400

Elimina enabled y disabled. Fable 5.1 es adaptive-only; baja effort o el alcance de la tarea si necesitas controlar el presupuesto.

Invalid signature o bloque incompatible

Restaura exactamente system, tools y el prefijo de mensajes, o inicia un diálogo nuevo. No repitas indefinidamente el mismo body inválido.

Unknown model

Usa claude-fable-5-1, no el nombre visible ni un alias antiguo. En OmniaKey comprueba primero el catálogo y el base URL.

La factura supera la respuesta visible

Revisa entrada sin caché, ambas escrituras, lecturas, output de thinking, herramientas, reintentos, impuestos y multiplicadores de ruta.

¿Merece la pena actualizar a Claude Fable 5.1?

La actualización merece una prueba cuando la tarea es larga, ambigua, intensiva en herramientas o cara de reparar tras un desvío. El menor precio de lectura de caché ayuda si reutilizas un prefijo estable durante muchos turnos. No es automáticamente el mejor modelo para programar a diario: la entrada y la salida siguen al nivel de Fable 5. Consulta la página del modelo Claude Fable 5.1 para la ruta actual y la página de Fable 5 para comparar la versión anterior. Para trabajo normal, compara primero con Claude Opus 5 o Sonnet.

La guía amplia de selección de Claude Code está en esta guía de modelos. El análisis del modelo anterior está en la guía de precio de Fable 5, y la comparación entre proveedores en Fable 5 frente a GPT-5.6 Sol.

Compara el coste de una tarea aceptada, no solo el precio por token:

text
accepted-task cost = successful-run charges
                   + failed retries
                   + human correction time
                   + remediation risk

Usa el mismo commit, prompt, herramientas, permisos, esfuerzo y comandos de aceptación. El nombre del modelo no es un benchmark.

Preguntas frecuentes

¿Qué es Claude Fable 5.1?

Claude Fable 5.1 es el modelo más reciente de Anthropic para programación agéntica de larga duración, investigación y conocimiento aplicado. Tiene contexto de 1M, salida máxima de 128K y adaptive thinking siempre activo.

¿Qué cambia respecto a Claude Fable 5?

La entrada, las escrituras de caché y la salida no cambian, pero la lectura baja a $0.25/MTok. También llegan controles beta de effort y progreso, mientras que la selección forzada de herramientas y algunos cambios del historial pueden devolver 400.

¿Cuánto cuesta Claude Fable 5.1?

Anthropic publica $10.00 de entrada, $12.50 por escritura 5m, $20.00 por escritura 1h, $0.25 por lectura y $50.00 de salida por millón de tokens. La tarifa de OmniaKey se muestra aparte en el catálogo en vivo.

¿Fable 5.1 es más barato que Fable 5?

No en todo. Entrada, escrituras y salida no cambian; la lectura baja de $1/MTok a $0.25/MTok. El coste final depende de la mezcla de tokens, herramientas y reintentos.

¿Se puede desactivar el thinking?

No. Adaptive thinking siempre está activo. Usa effort y un max_tokens medido.

¿Puedo usar Fable 5.1 en Claude Code?

Sí, cuando el proveedor activo lo ofrece y el cliente admite el modelo. La ruta compatible de OmniaKey requiere una identidad de Claude Code de al menos 2.1.251.

¿Es adecuado para zero-data-retention?

Confirma la política del proveedor y de la ruta exacta. Las condiciones de retención de Fable 5.1 pueden ser distintas; no envíes código sensible sin esa confirmación.

Fuentes comprobadas

Verificado el 4 de septiembre de 2026. Las tarifas, la disponibilidad, la caché, la retención y las reglas del gateway pueden cambiar. Revisa las fuentes primarias y el catálogo en vivo antes de usar tráfico o presupuesto de producción.