GPT-6 Sol y Claude Opus 5.5 ya disponiblesGPT-6 Sol por la mitad del precio de 5.6 Sol
Blog
Guía

Reseña de Claude Sonnet 5.5

Un modelo diario más rápido, con una migración de API más importante de lo que su número sugiere.

12 min de lecturaOmniaKey
Claude Sonnet 5.5Reseña de modeloPrecio de APIClaude CodeMigración

Claude Sonnet 5.5 es la actualización práctica de la familia Claude 5.5 de Anthropic. Se lanzó el 28 de septiembre de 2026. Mantiene el mismo precio estándar por token que Sonnet 5, pero Anthropic afirma que genera respuestas un 30% o más rápido y que puede costar hasta un 30% menos por tarea porque usa menos tokens. Sus resultados publicados en programación y trabajo de conocimiento también se acercan a los de Opus 5.5.

Eso no convierte a Sonnet 5.5 en un reemplazo universal de Opus. Su mejor terreno son las tareas bien acotadas: programación diaria, corrección de bugs reproducibles, documentos, hojas de cálculo y ciclos rápidos de un agente. Para quien mantiene una integración, el cambio más importante está en el contrato de API. Un cliente de Sonnet 5 que desactive thinking, fuerce herramientas, use el antiguo computer use o lea únicamente content[0] necesita una revisión antes de cambiar el nombre del modelo.

Comprobado el 29 de septiembre de 2026. Esta reseña usa el anuncio de Anthropic y la documentación actual de Claude Platform. Los benchmarks, la velocidad y los ahorros son cifras publicadas por Anthropic; no ejecutamos un benchmark independiente de pago ni una medición de latencia. Los ejemplos de coste usan la tarifa directa global y mantienen constantes los tokens.

Especificaciones de Claude Sonnet 5.5

EspecificaciónClaude Sonnet 5.5
Lanzamiento28 de septiembre de 2026
ID de Claude APIclaude-sonnet-5-5
Ventana de contexto1M tokens
Salida máxima estándar128K tokens
Entrada / salida$2 / $10 por millón de tokens
Escritura / lectura de caché$2.50 / $0.20 por millón
ThinkingAdaptive por defecto
Effort por defectohigh
Latencia comparativaFast
Corte de conocimiento fiableJunio de 2026
Entrada y salidaTexto e imágenes → texto

Está disponible en Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry y Claude Platform on AWS. El identificador puede variar entre plataformas, así que hay que comprobar la tabla de disponibilidad del proveedor antes de actualizar producción. La API Messages síncrona ofrece 1M de contexto y 128K de salida; Batch API puede llegar a 300K con su encabezado beta, que es un límite distinto.

Qué mejora frente a Sonnet 5

La afirmación principal es más de un 30% de velocidad de generación y hasta un 30% menos de coste por tarea. No se ha rebajado el precio de cada token: el ahorro viene de usar menos tokens de salida y menos pasos de herramientas.

EvaluaciónSonnet 5.5Sonnet 5Qué mide
Terminal-Bench 4.070.6%10.3%Programación de terminal en varios pasos
CursorBench 4.055.5%34.1%Tareas ambiguas de agentes de código
GDPval-AA v2.118441449Trabajo de conocimiento en varias profesiones
AA-Briefcase v1.118111359Trabajo de conocimiento de largo recorrido
Humanity’s Last Exam64.5%54.9%Razonamiento multidisciplinar con herramientas
OSWorld 2.180.1% parcial57.0% parcialComputer use
Chartography61.6%15.6%Reconocimiento visual de gráficos

Son señales útiles, no una tasa de éxito en tu repositorio. CursorBench queda cerca del 57.8% de Opus 5.5 y GDPval cerca de su 1846, pero Anthropic sigue describiendo Opus como más fuerte en trabajo abierto y decisiones sostenidas. La lectura prudente es que Sonnet 5.5 reduce la distancia en tareas repetibles, no que elimina la necesidad de un modelo de escalado.

Los gráficos de coste de Anthropic incluyen effort, herramientas y todos los tokens de una tarea. Mantén constantes prompt, permisos, commit, herramientas y prueba de aceptación cuando compares con la página de Opus 5.5 o con tu ruta actual de Sonnet.

El precio de la API no cambió

Sonnet 5.5 conserva la tarifa directa de Sonnet 5:

ConceptoPrecio
Entrada sin caché$2 / MTok
Salida, incluidos tokens de thinking facturados$10 / MTok
Escritura de caché de 5 minutos$2.50 / MTok
Escritura de caché de 1 hora$4 / MTok
Lectura de caché$0.20 / MTok
Batch API50% de descuento en entrada y salida

Una tarea sin caché con 100K tokens de entrada y 20K de salida cuesta 0.1 × $2 + 0.02 × $10 = $0.40. Si 80K de entrada son aciertos de caché, el mismo volumen cuesta 0.02 × $2 + 0.08 × $0.20 + 0.02 × $10 = $0.376, antes de la escritura inicial. Thinking, herramientas, reintentos y número de turnos cambian la factura real.

Por eso “hasta un 30% menos por tarea” no significa que toda factura tenga un 30% de descuento. Mide el coste de cada cambio aceptado: tokens de entrada, caché, salida y herramientas divididos por los resultados que pasan tus pruebas o revisión. El precio de OmniaKey es una ruta distinta; consulta el catálogo de modelos antes de presupuestar.

Seis cambios de API que debes probar al migrar

El ID nuevo es claude-sonnet-5-5, pero no todos los parámetros de Sonnet 5 siguen siendo válidos.

  1. Thinking es Adaptive por defecto. Omite thinking o usa {"type":"adaptive"}. Para quitar el pensamiento inicial usa thinking: {"type":"between_tools"}. {"type":"disabled"} y budget_tokens manual devuelven 400.
  2. No se admite el uso forzado de herramientas. tool_choice con any o tool devuelve 400. Usa auto o none; para validar argumentos, usa herramientas strict o structured outputs.
  3. Los thinking blocks están ligados al modelo y la conversación. Sonnet 5.5 puede leer bloques de Sonnet 5, pero Opus 5 y Opus 5.5 no leen los que produce Sonnet 5.5. Cambiar de modelo en mitad de una conversación cambia lo que el siguiente turno puede ver.
  4. No edites el historial y repitas el bloque sin revisar. Cambiar un system, una herramienta o un mensaje anterior puede producir 400 en cuentas con las comprobaciones nuevas. Añade instrucciones o usa el control de binding documentado.
  5. Actualiza computer use según la plataforma. Claude API y Google Cloud requieren computer_toolset_20260801; Bedrock todavía acepta computer_20251124.
  6. Lee la respuesta por tipo de bloque. El progreso entre herramientas puede llegar como thinking. Un cliente que solo pinta text puede parecer bloqueado aunque la solicitud haya terminado bien.

Un request mínimo con thinking adaptativo es:

json
{
  "model": "claude-sonnet-5-5",
  "max_tokens": 4096,
  "output_config": {"effort": "high"},
  "messages": [{"role": "user", "content": "Revisa esta migración y enumera sus tres riesgos principales."}]
}

Revisa también temperature, top_p y top_k: valores no predeterminados pueden devolver 400. Reserva espacio en max_tokens para el pensamiento y la respuesta visible.

Dónde encaja en un flujo real

Empieza con Sonnet 5.5 para una feature acotada, un bug reproducible, pruebas sobre una interfaz conocida, una revisión concreta, un primer documento o pasos de agente de alto volumen. Las pruebas, el typecheck, el build y las capturas hacen visible rápidamente si el modelo barato es suficiente.

Sube el effort o cambia de modelo cuando la tarea cruce servicios, exija una decisión arquitectónica difícil o tenga requisitos incompletos. Si Sonnet recibió los archivos correctos, usó las herramientas y aun así no encontró la causa, es una señal de capacidad. Si no verificó por falta de contexto, arregla primero el contexto.

En Claude Code compara sesiones nuevas con el mismo commit, permisos, prompt y prueba de aceptación. Registra el primer resultado útil, el tiempo total, tokens facturados, reintentos, herramientas fallidas y minutos de reparación humana. Más velocidad por token no garantiza una entrega más rápida si añade una ronda de revisión.

Veredicto

Claude Sonnet 5.5 merece ser el primer modelo que pruebes para programación y trabajo de conocimiento diario. Mantiene el precio, mejora la velocidad y los resultados publicados, y ofrece una razón clara para mover tareas bien definidas desde Sonnet 5.

No lo publiques cambiando solo una cadena. Comprueba thinking, tool choice, el parser de bloques y computer use. Reserva Opus 5.5 para arquitectura ambigua, debugging difícil y decisiones de alto impacto. Para elegir entre la familia, consulta también la comparativa Opus 5.5 y Sonnet 5.

Preguntas frecuentes

¿Cuándo salió Claude Sonnet 5.5?

Anthropic lo publicó el 28 de septiembre de 2026. Su ID directo es claude-sonnet-5-5.

¿Es más barato que Sonnet 5?

El precio por token es igual: $2 por millón de entrada, $10 por millón de salida y $0.20 por millón de lectura de caché. Anthropic afirma hasta un 30% menos por tarea gracias al menor consumo.

¿Es mejor que Opus 5.5?

Depende del trabajo. Sonnet es más rápido y barato para tareas acotadas; Opus es más fuerte para decisiones complejas y abiertas. Compara resultados aceptados, coste total y correcciones.

¿Se puede desactivar thinking?

No con thinking: {"type":"disabled"}. Usa thinking adaptativo o thinking: {"type":"between_tools"} en los niveles de effort compatibles.

¿Tiene un contexto de 1M?

Sí, además de 128K de salida estándar. Son límites de capacidad, no créditos gratuitos ni uso ilimitado.

Fuentes consultadas