GPT-6.1 Sol: análisis
Valora el cambio por la calidad y el coste total.
Si ya utilizas GPT-6 Sol para programación compleja y revisiones frecuentes, merece la pena evaluar primero GPT-6.1 Sol. Mantiene las tarifas estándar de entrada y salida, reduce a la mitad la lectura de caché y mejora en varias evaluaciones publicadas por OpenAI. Conserva Astra como alternativa cuando investigar un fallo o corregir una solución equivocada resulte costoso.
El precio por token y el coste de terminar una tarea responden a preguntas distintas. La propia evaluación de programación de OpenAI muestra un caso en el que el nuevo Sol obtiene una puntuación mucho mayor, pero cuesta algo más por tarea que el anterior. Ese matiz ayuda más a decidir que una promesa general de sustituir Astra por una quinta parte del coste.
Fuentes comprobadas el 30 de septiembre de 2026, UTC. Este análisis utiliza documentación oficial y resultados atribuidos a su autor. No hemos realizado una prueba independiente entre modelos. Los ejemplos económicos emplean cantidades hipotéticas de tokens. OmniaKey publica este artículo y ofrece una pasarela API; sus tarifas son distintas de las de la API directa de OpenAI.
Qué cambia con GPT-6.1 Sol
El registro de cambios de la API fecha el lanzamiento el 29 de septiembre de 2026. El identificador es gpt-6.1-sol. OpenAI lo orienta a programación compleja, uso del ordenador y trabajo profesional con menor coste que Astra.
| Característica | GPT-6.1 Sol |
|---|---|
| Ventana de contexto | 1.050.000 tokens |
| Salida máxima | 128.000 tokens |
| Entrada / salida nativa | Texto e imágenes / texto |
| Esfuerzo de razonamiento en la API | low, medium (predeterminado), high, xhigh, max |
| API para herramientas | Responses |
Las fichas de Sol 6.1, Sol 6 y Astra indican las mismas capacidades de contexto y salida. No se amplía la ventana. El razonamiento y la salida también ocupan contexto; una capacidad idéntica no demuestra la misma precisión al recuperar información. Este modelo no admite audio ni vídeo de forma nativa.
Programación: comparar el mismo nivel de razonamiento
El gráfico interactivo de DeepSWE v1.1 del anuncio de OpenAI permite comparar tareas complejas sobre bases de código reales. Las tres filas siguientes usan medium. Los costes son los medidos por quien publica la evaluación, no facturas de OmniaKey ni los ejemplos hipotéticos de esta guía.
Modelo en medium | Puntuación DeepSWE v1.1 | Coste medio por tarea |
|---|---|---|
| GPT-6.1 Sol | 73,0% | 0,42 USD |
| GPT-6 Sol | 56,6% | 0,38 USD |
| GPT-6 Astra | 72,8% | 3,08 USD |
En esta prueba, el nuevo Sol se acerca a Astra con un coste muy inferior. La diferencia de 0,2 puntos porcentuales no demuestra superioridad general ni significación estadística. Frente al antiguo Sol, el coste por tarea sube de 0,38 a 0,42 USD pese a conservar las tarifas estándar. También importa cuánto utiliza cada modelo.
Más razonamiento tampoco garantiza más aciertos: Sol 6.1 obtiene 75,2% con high, por 0,65 USD, y 71,9% con max, por 1,57 USD. La mejora anunciada de 6,4 puntos compara el high del nuevo Sol con el mejor resultado del antiguo, 68,8% en max. No es la diferencia entre ambos en medium.
En AutomationBench 1.0.6, el resultado con medium mejora 4,8 puntos porcentuales frente al antiguo Sol. En el conjunto sin conexión v2026.08.08 de OSWorld 2.0, la recompensa parcial con max sube 7 puntos y queda 2,1 puntos por debajo de Astra en ese mismo nivel. La recompensa parcial no equivale a una tasa universal de tareas de escritorio completadas.
El anuncio en inglés también registra una bajada del 11,4% al 7,7% en respuestas con al menos un error factual, usando low sobre conversaciones difíciles seleccionadas expresamente. No representa el error habitual de cualquier consulta. En Terminal-Bench Science 0.1, Astra mantiene la mayor puntuación del grupo evaluado: 68,1% con max. Son motivos para probar Sol 6.1, no para retirar Astra de todos los procesos.
Precio API: qué se abarata realmente
La siguiente tabla usa las tarifas oficiales de OpenAI directo, Standard, en USD por millón de tokens y con un máximo de 272K tokens de entrada. Las cuotas de suscripción, otras plataformas, herramientas e impuestos se calculan aparte.
| Categoría | GPT-6.1 Sol | GPT-6 Sol | GPT-6 Astra |
|---|---|---|---|
| Entrada sin caché | 2,00 USD | 2,00 USD | 10,00 USD |
| Lectura de caché | 0,10 USD | 0,20 USD | 1,00 USD |
| Escritura en caché | 2,50 USD | 2,50 USD | 12,50 USD |
| Salida | 10,00 USD | 10,00 USD | 50,00 USD |
De estas cuatro tarifas, solo baja la lectura respecto al antiguo Sol. La entrada y salida estándar cuestan una quinta parte de Astra; las lecturas, una décima parte. Esas proporciones no determinan la factura de un trabajo completo.
Cuatro ejemplos que puedes recalcular
K equivale a 1.000 tokens. La salida incluye el razonamiento facturado. Fijamos las mismas cantidades para los tres modelos, aunque en una ejecución real pueden variar. Solo la fila de lectura presupone un acierto de caché válido; la escritura anterior se cobra aparte. Excluimos herramientas, infraestructura, impuestos y cargos de la pasarela.
| Uso hipotético | GPT-6.1 Sol | GPT-6 Sol | GPT-6 Astra |
|---|---|---|---|
| 100K de entrada sin caché + 10K de salida | 0,30 USD | 0,30 USD | 1,50 USD |
| Escritura inicial de 200K + entrada sin caché de 20K + salida de 10K | 0,64 USD | 0,64 USD | 3,20 USD |
| Lectura de 200K + entrada sin caché de 20K + salida de 10K | 0,16 USD | 0,18 USD | 0,90 USD |
| Entrada sin caché de 300K + salida de 10K, tarifa de contexto largo | 1,35 USD | 1,35 USD | 6,75 USD |
La fila de lectura de Sol 6.1 se calcula así, con notación decimal de código: 0.20 × $0.10 + 0.02 × $2 + 0.01 × $10 = $0.16. Con el antiguo Sol cuesta 0,18 USD. Rebajar un 50% la lectura ahorra un 11,1% en esta petición completa. Una escritura inicial y diez lecturas idénticas válidas suman 2,24 frente a 2,44 USD: aproximadamente 8,2% menos. Se presupone que el prefijo sigue disponible y todas las lecturas aciertan.
La guía de caché aclara que escribir no añade un segundo cargo de entrada normal. Clasifica cada token como entrada sin caché, lectura o escritura, sin contabilizarlo dos veces.
El umbral de 272K afecta a toda la petición
Si la entrada supera 272K, se duplican las tarifas de entrada y caché, y la salida se multiplica por 1,5 en toda la petición. La entrada cacheada también cuenta para la longitud. Por eso el ejemplo de 300K cuesta 0.30 × $4 + 0.01 × $15 = $1.35 con Sol 6.1.
Los tokens de razonamiento se facturan como salida. Fast cuesta el doble de Standard; Batch y Flex, la mitad. Estas relaciones de precio no indican el tiempo total hasta terminar: registra también reintentos y esperas de herramientas.
Tres comprobaciones para migrar
La guía de GPT-6 describe diferencias que afectan a los agentes existentes.
- Razonamiento: el antiguo Sol admite
none; el nuevo no admitenoneniminimal. Elige un nivel compatible y vuelve a medir consumo y latencia. La API usamediumpor defecto, pero cada cliente puede tener otro valor. - Herramientas: el antiguo Sol permite llamadas a funciones mediante Chat Completions solo con
reasoning_effort: "none". Sol 6.1 necesita Responses para herramientas. Chat Completions sigue disponible sin herramientas. - Muestreo: elimina parámetros incompatibles como
temperatureytop_pcon razonamiento activo. Revisa los valores que añaden automáticamente el SDK o la pasarela.
La selección documentada en Codex CLI es:
codex --model gpt-6.1-sol
En una sesión interactiva se utiliza /model. Son instrucciones documentadas; no hemos comprobado una llamada con una cuenta para este análisis.
Dónde está disponible
La guía de modelos de Codex incluye en el lanzamiento las superficies correspondientes de Work y Codex para Plus, Pro, Business, Enterprise y Edu. Enterprise y Edu requieren activación del administrador; Free y Go quedan fuera del despliegue inicial. En ChatGPT se ofrece en Work y Codex, no en Chat ordinario al lanzarse. Confirma los modos de velocidad en tu cuenta, cliente y espacio de trabajo.
El uso de suscripciones y créditos está separado de la API. Los créditos de Codex no tienen un cargo independiente por escritura en caché. Los cálculos anteriores no sirven para prometer cuántas tareas incluye un plan.
Cómo decidir si debe ser tu modelo habitual
Para usuarios del antiguo Sol, la tarifa estándar sin cambios y las mejoras publicadas justifican una prueba controlada. Si utilizas Astra, empieza comparando tareas frecuentes con criterios de aceptación claros. Mantén una alternativa cuando los fallos y las correcciones humanas pesen más que el coste de tokens.
Un piloto útil consta de seis tareas: dos errores reproducidos, dos cambios entre archivos y dos preguntas documentales que exijan pruebas. Ejecuta cada una tres veces por modelo, con entorno nuevo, entradas, herramientas, permisos y presupuesto de reintentos constantes. Compara primero medium explícito y presenta por separado cualquier ajuste posterior. Es una propuesta, no una prueba que hayamos realizado.
Registra aceptación, omisiones, tiempo total, tokens facturados, intentos fallidos y correcciones humanas. Divide el gasto de todos los intentos por los resultados aceptados; si no hay ninguno, indícalo. Este pequeño piloto no establece una tasa de éxito universal.
Consulta el análisis del antiguo GPT-6 Sol y la comparación anterior con Astra como antecedentes. El catálogo de modelos muestra las rutas y tarifas actuales de OmniaKey. El lanzamiento oficial no confirma disponibilidad en una pasarela concreta. Las fuentes de OpenAI enlazadas están en inglés.