GPT-6 Sol y Claude Opus 5.5 ya disponiblesGPT-6 Sol por la mitad del precio de 5.6 Sol
Blog
Guía

GPT-6.1 Sol: análisis

Valora el cambio por la calidad y el coste total.

10 min de lecturaOmniaKey
GPT-6.1 SolGPT-6 AstraProgramaciónPrecio APIAnálisis de modelos

Si ya utilizas GPT-6 Sol para programación compleja y revisiones frecuentes, merece la pena evaluar primero GPT-6.1 Sol. Mantiene las tarifas estándar de entrada y salida, reduce a la mitad la lectura de caché y mejora en varias evaluaciones publicadas por OpenAI. Conserva Astra como alternativa cuando investigar un fallo o corregir una solución equivocada resulte costoso.

El precio por token y el coste de terminar una tarea responden a preguntas distintas. La propia evaluación de programación de OpenAI muestra un caso en el que el nuevo Sol obtiene una puntuación mucho mayor, pero cuesta algo más por tarea que el anterior. Ese matiz ayuda más a decidir que una promesa general de sustituir Astra por una quinta parte del coste.

Fuentes comprobadas el 30 de septiembre de 2026, UTC. Este análisis utiliza documentación oficial y resultados atribuidos a su autor. No hemos realizado una prueba independiente entre modelos. Los ejemplos económicos emplean cantidades hipotéticas de tokens. OmniaKey publica este artículo y ofrece una pasarela API; sus tarifas son distintas de las de la API directa de OpenAI.

Qué cambia con GPT-6.1 Sol

El registro de cambios de la API fecha el lanzamiento el 29 de septiembre de 2026. El identificador es gpt-6.1-sol. OpenAI lo orienta a programación compleja, uso del ordenador y trabajo profesional con menor coste que Astra.

CaracterísticaGPT-6.1 Sol
Ventana de contexto1.050.000 tokens
Salida máxima128.000 tokens
Entrada / salida nativaTexto e imágenes / texto
Esfuerzo de razonamiento en la APIlow, medium (predeterminado), high, xhigh, max
API para herramientasResponses

Las fichas de Sol 6.1, Sol 6 y Astra indican las mismas capacidades de contexto y salida. No se amplía la ventana. El razonamiento y la salida también ocupan contexto; una capacidad idéntica no demuestra la misma precisión al recuperar información. Este modelo no admite audio ni vídeo de forma nativa.

Programación: comparar el mismo nivel de razonamiento

El gráfico interactivo de DeepSWE v1.1 del anuncio de OpenAI permite comparar tareas complejas sobre bases de código reales. Las tres filas siguientes usan medium. Los costes son los medidos por quien publica la evaluación, no facturas de OmniaKey ni los ejemplos hipotéticos de esta guía.

Modelo en mediumPuntuación DeepSWE v1.1Coste medio por tarea
GPT-6.1 Sol73,0%0,42 USD
GPT-6 Sol56,6%0,38 USD
GPT-6 Astra72,8%3,08 USD

En esta prueba, el nuevo Sol se acerca a Astra con un coste muy inferior. La diferencia de 0,2 puntos porcentuales no demuestra superioridad general ni significación estadística. Frente al antiguo Sol, el coste por tarea sube de 0,38 a 0,42 USD pese a conservar las tarifas estándar. También importa cuánto utiliza cada modelo.

Más razonamiento tampoco garantiza más aciertos: Sol 6.1 obtiene 75,2% con high, por 0,65 USD, y 71,9% con max, por 1,57 USD. La mejora anunciada de 6,4 puntos compara el high del nuevo Sol con el mejor resultado del antiguo, 68,8% en max. No es la diferencia entre ambos en medium.

En AutomationBench 1.0.6, el resultado con medium mejora 4,8 puntos porcentuales frente al antiguo Sol. En el conjunto sin conexión v2026.08.08 de OSWorld 2.0, la recompensa parcial con max sube 7 puntos y queda 2,1 puntos por debajo de Astra en ese mismo nivel. La recompensa parcial no equivale a una tasa universal de tareas de escritorio completadas.

El anuncio en inglés también registra una bajada del 11,4% al 7,7% en respuestas con al menos un error factual, usando low sobre conversaciones difíciles seleccionadas expresamente. No representa el error habitual de cualquier consulta. En Terminal-Bench Science 0.1, Astra mantiene la mayor puntuación del grupo evaluado: 68,1% con max. Son motivos para probar Sol 6.1, no para retirar Astra de todos los procesos.

Precio API: qué se abarata realmente

La siguiente tabla usa las tarifas oficiales de OpenAI directo, Standard, en USD por millón de tokens y con un máximo de 272K tokens de entrada. Las cuotas de suscripción, otras plataformas, herramientas e impuestos se calculan aparte.

CategoríaGPT-6.1 SolGPT-6 SolGPT-6 Astra
Entrada sin caché2,00 USD2,00 USD10,00 USD
Lectura de caché0,10 USD0,20 USD1,00 USD
Escritura en caché2,50 USD2,50 USD12,50 USD
Salida10,00 USD10,00 USD50,00 USD

De estas cuatro tarifas, solo baja la lectura respecto al antiguo Sol. La entrada y salida estándar cuestan una quinta parte de Astra; las lecturas, una décima parte. Esas proporciones no determinan la factura de un trabajo completo.

Cuatro ejemplos que puedes recalcular

K equivale a 1.000 tokens. La salida incluye el razonamiento facturado. Fijamos las mismas cantidades para los tres modelos, aunque en una ejecución real pueden variar. Solo la fila de lectura presupone un acierto de caché válido; la escritura anterior se cobra aparte. Excluimos herramientas, infraestructura, impuestos y cargos de la pasarela.

Uso hipotéticoGPT-6.1 SolGPT-6 SolGPT-6 Astra
100K de entrada sin caché + 10K de salida0,30 USD0,30 USD1,50 USD
Escritura inicial de 200K + entrada sin caché de 20K + salida de 10K0,64 USD0,64 USD3,20 USD
Lectura de 200K + entrada sin caché de 20K + salida de 10K0,16 USD0,18 USD0,90 USD
Entrada sin caché de 300K + salida de 10K, tarifa de contexto largo1,35 USD1,35 USD6,75 USD

La fila de lectura de Sol 6.1 se calcula así, con notación decimal de código: 0.20 × $0.10 + 0.02 × $2 + 0.01 × $10 = $0.16. Con el antiguo Sol cuesta 0,18 USD. Rebajar un 50% la lectura ahorra un 11,1% en esta petición completa. Una escritura inicial y diez lecturas idénticas válidas suman 2,24 frente a 2,44 USD: aproximadamente 8,2% menos. Se presupone que el prefijo sigue disponible y todas las lecturas aciertan.

La guía de caché aclara que escribir no añade un segundo cargo de entrada normal. Clasifica cada token como entrada sin caché, lectura o escritura, sin contabilizarlo dos veces.

El umbral de 272K afecta a toda la petición

Si la entrada supera 272K, se duplican las tarifas de entrada y caché, y la salida se multiplica por 1,5 en toda la petición. La entrada cacheada también cuenta para la longitud. Por eso el ejemplo de 300K cuesta 0.30 × $4 + 0.01 × $15 = $1.35 con Sol 6.1.

Los tokens de razonamiento se facturan como salida. Fast cuesta el doble de Standard; Batch y Flex, la mitad. Estas relaciones de precio no indican el tiempo total hasta terminar: registra también reintentos y esperas de herramientas.

Tres comprobaciones para migrar

La guía de GPT-6 describe diferencias que afectan a los agentes existentes.

  1. Razonamiento: el antiguo Sol admite none; el nuevo no admite none ni minimal. Elige un nivel compatible y vuelve a medir consumo y latencia. La API usa medium por defecto, pero cada cliente puede tener otro valor.
  2. Herramientas: el antiguo Sol permite llamadas a funciones mediante Chat Completions solo con reasoning_effort: "none". Sol 6.1 necesita Responses para herramientas. Chat Completions sigue disponible sin herramientas.
  3. Muestreo: elimina parámetros incompatibles como temperature y top_p con razonamiento activo. Revisa los valores que añaden automáticamente el SDK o la pasarela.

La selección documentada en Codex CLI es:

bash
codex --model gpt-6.1-sol

En una sesión interactiva se utiliza /model. Son instrucciones documentadas; no hemos comprobado una llamada con una cuenta para este análisis.

Dónde está disponible

La guía de modelos de Codex incluye en el lanzamiento las superficies correspondientes de Work y Codex para Plus, Pro, Business, Enterprise y Edu. Enterprise y Edu requieren activación del administrador; Free y Go quedan fuera del despliegue inicial. En ChatGPT se ofrece en Work y Codex, no en Chat ordinario al lanzarse. Confirma los modos de velocidad en tu cuenta, cliente y espacio de trabajo.

El uso de suscripciones y créditos está separado de la API. Los créditos de Codex no tienen un cargo independiente por escritura en caché. Los cálculos anteriores no sirven para prometer cuántas tareas incluye un plan.

Cómo decidir si debe ser tu modelo habitual

Para usuarios del antiguo Sol, la tarifa estándar sin cambios y las mejoras publicadas justifican una prueba controlada. Si utilizas Astra, empieza comparando tareas frecuentes con criterios de aceptación claros. Mantén una alternativa cuando los fallos y las correcciones humanas pesen más que el coste de tokens.

Un piloto útil consta de seis tareas: dos errores reproducidos, dos cambios entre archivos y dos preguntas documentales que exijan pruebas. Ejecuta cada una tres veces por modelo, con entorno nuevo, entradas, herramientas, permisos y presupuesto de reintentos constantes. Compara primero medium explícito y presenta por separado cualquier ajuste posterior. Es una propuesta, no una prueba que hayamos realizado.

Registra aceptación, omisiones, tiempo total, tokens facturados, intentos fallidos y correcciones humanas. Divide el gasto de todos los intentos por los resultados aceptados; si no hay ninguno, indícalo. Este pequeño piloto no establece una tasa de éxito universal.

Consulta el análisis del antiguo GPT-6 Sol y la comparación anterior con Astra como antecedentes. El catálogo de modelos muestra las rutas y tarifas actuales de OmniaKey. El lanzamiento oficial no confirma disponibilidad en una pasarela concreta. Las fuentes de OpenAI enlazadas están en inglés.