DeepSeek V4 Flash ya está disponible · Nuestro precio de GLM-5.2 baja al 50% del oficial
Blog
Guía

Reseña de GPT-6 Astra: qué comprobar antes de migrar

GPT-6 Astra es un único modelo insignia, no una nueva familia Sol/Terra/Luna. Separamos los hechos de API, la disponibilidad en Codex y la economía del gateway OmniaKey.

15 min de lecturaOmniaKey
GPT-6 AstraAPI pricingreasoningCodexmodel review

GPT-6 Astra está pensado para el trabajo extremo de principio a fin: razonamiento, programación, uso del ordenador, investigación y creación de documentos. Es importante no confundirlo con otra familia: Astra es un único modelo con el ID gpt-6-astra, no una nueva versión de Sol, Terra y Luna.

Empieza con Astra cuando una decisión equivocada, una restricción perdida o un bucle de herramientas fallido sea caro. Conserva GPT-5.6 Sol, Terra y Luna cuando alcanzan el mismo criterio de aceptación a menor coste. La comparación debe usar el mismo commit, herramientas, permisos y pruebas, no solo una impresión del nombre de versión.

Verificado el 4 de septiembre de 2026. Comprobamos las páginas oficiales de OpenAI sobre el modelo, precios, latest-model, selección de modelos y Codex, además de la página de Astra en OmniaKey. No ejecutamos un benchmark independiente controlado; el acceso y el precio pueden cambiar.

Respuesta rápida

PreguntaRespuesta comprobada
ID exactogpt-6-astra
Uso principalRazonamiento, código, ordenador, investigación y documentos de máxima dificultad
Contexto1.050.000 tokens; máximo de entrada 922.000 y salida 128.000
ModalidadesTexto e imagen de entrada; texto de salida
Effortlow, medium, high, xhigh, max; none no está disponible
Precio Standard de OpenAI$10 input, $1 cached input, $12.50 cache write y $50 output por millón
Regla de 272KAl superar el umbral se repricinga toda la petición
OmniaKeyEl catálogo activo incluye gpt-6-astra; es una tarifa y un acceso separados
Codex cloudLa matriz actual muestra desktop, web, CLI e IDE, pero no Codex cloud

Astra frente a GPT-5.6

OpenAI describe Astra como su modelo más capaz para tareas complejas de extremo a extremo. Es posicionamiento del proveedor, no una clasificación independiente de todos los repositorios.

DimensiónGPT-6 AstraFamilia GPT-5.6
FormaUn modelo insigniaSol, Terra y Luna
IDgpt-6-astragpt-5.6-sol, gpt-5.6-terra, gpt-5.6-luna
PapelTrabajo end-to-end más difícilSol difícil, Terra equilibrado, Luna repetible y económico
Input/output Standard$10 / $50Sol $4 / $20, Terra $2 / $12, Luna $0.20 / $1.20

Para escoger dentro de GPT-5.6, consulta la reseña de GPT-5.6. Esta página cubre Astra y las comprobaciones de migración.

Especificaciones oficiales

EspecificaciónGPT-6 Astra
Modelo y snapshotgpt-6-astra
Ventana de contexto1.050.000 tokens
Máximo de entrada / salida922.000 / 128.000
Corte de conocimiento30 de abril de 2026
Entrada / salidaTexto, imagen / texto
Reasoning effortlow, medium, high, xhigh, max
Streaming, structured outputs, function callingCompatibles
Fine-tuningNo compatible

La ventana incluye historial, esquemas de herramientas, archivos, imágenes, tokens de razonamiento y salida. Que quepa un repositorio no significa que enviarlo completo sea útil ni barato.

Endpoints y herramientas

La página de Astra enumera Chat Completions y Responses. La guía de migración añade un límite importante: Chat Completions está disponible, pero el tool calling de Astra requiere Responses. Para agentes nuevos, empieza con /v1/responses y comprueba la ruta exacta del gateway.

CapacidadEstado
Chat CompletionsCompatible
ResponsesCompatible y recomendado para herramientas
BatchCompatible
Realtime, traducción y transcripción realtimeNo compatibles
Assistants y Completions legacyNo compatibles
Fine-tuning, embeddings y moderationNo compatibles

En Responses, OpenAI lista web search, file search, image generation, code interpreter, hosted shell, Apply Patch, skills, computer use, MCP y tool search. El modelo puede emitir una llamada, pero tu aplicación conserva la autorización, el sandbox, la validación de argumentos, los timeouts y la revisión de efectos secundarios.

También aparecen llamadas asíncronas a herramientas, mid-turn steering por WebSocket, cambios de effort mediante configuration_update y monitorización asíncrona de desalineación. Son primitivas de flujo, no sustitutos de los límites de permisos y auditoría.

Reasoning y migración

Astra no admite none. Si el cliente antiguo envía none o minimal, empieza con low y compara medium y high usando el mismo conjunto de aceptación. Un effort mayor puede aumentar latencia y tokens facturados; no garantiza corrección.

Los tokens de razonamiento no aparecen en el texto, pero ocupan contexto y se facturan como salida. Con un max_output_tokens demasiado bajo, la respuesta puede quedar incomplete durante el razonamiento. Revisa output_tokens_details.reasoning_tokens y reserva presupuesto suficiente.

Precios oficiales de OpenAI

Valores en USD por millón de tokens.

ProcesamientoInputCached inputCache writeOutput
Standard, hasta 272K$10.00$1.00$12.50$50.00
Standard, más de 272K$20.00$2.00$25.00$75.00
Batch/Flex, hasta 272K$5.00$0.50$6.25$25.00
Batch/Flex, más de 272K$10.00$1.00$12.50$37.50
Fast, hasta 272K$20.00$2.00$25.00$100.00
Fast, más de 272K$40.00$4.00$50.00$150.00

Cache write cuesta 1,25× el input normal; Batch y Flex cuestan el 50% de Standard; Fast cuesta 2×. OpenAI indica que Fast no está disponible para Astra con EU data residency y que el procesamiento regional puede añadir 10%.

Superar 272.000 tokens de entrada cambia el precio de toda la petición. 100K de entrada + 10K de salida cuesta 0,1 × $10 + 0,01 × $50 = $1,50; 300K + 10K cuesta 0,3 × $20 + 0,01 × $75 = $6,75. Son cálculos de tokens sin herramientas, reintentos, impuestos ni tiempo humano.

Tarifas de OmniaKey

La página activa de OmniaKey muestra su propio gateway quote:

Tarifa OmniaKeyInputCache hitOutput
Toda la ventana de contexto indicada$0.70$0.07$3.50

Los dos ejemplos anteriores serían aproximadamente $0.105 y $0.245 en tokens. No son precios oficiales de OpenAI. OmniaKey mantiene esta tarifa baja en toda la ventana de contexto indicada y no añade un segundo tramo por entradas más largas. Antes de presupuestar, abre la página activa de Astra y el catálogo; el acceso, el failover y el ledger pertenecen a OmniaKey.

Prompt caching

La documentación de OpenAI para GPT-6 y GPT-5.6+ indica un prefijo visible mínimo de 1.024 tokens, cache write de 1,25×, cache read de 0,1× y prompt_cache_options.ttl: "30m". Los breakpoints explícitos evitan escribir sufijos variables; prompt_cache_key ayuda a dirigir tráfico, pero no garantiza un hit.

Un prefijo de 100.000 tokens escrito una vez y leído una vez con la tarifa Standard corta de Astra cuesta 0,1 × $12.50 + 0,1 × $1.00 = $1.35, frente a 2 × 0,1 × $10.00 = $2.00 sin caché. Mantén estables las instrucciones y los esquemas, y mide cached_tokens, cache writes, latencia y coste real. Al migrar, sustituye prompt_cache_retention por prompt_cache_options.ttl.

Lista de migración desde GPT-5.6

  1. Fija model: "gpt-6-astra" en la configuración y los informes.
  2. Usa Responses para herramientas:
bash
curl https://api.omniakey.com/v1/responses \
  -H "Authorization: Bearer $OMNIAKEY_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"gpt-6-astra","reasoning":{"effort":"medium"},"input":"Revisa este plan de migración y lista dos riesgos con pruebas de aceptación."}'
  1. Elimina temperature, top_p y top_logprobs; en Chat Completions elimina también logprobs, y en Responses elimina message.output_text.logprobs de include.
  2. Cambia none/minimal a low y compara los mismos casos en medium y high.
  3. Comprueba el TTL de caché, streaming, cancelación, argumentos de herramientas, efectos denegados e incomplete.
  4. Registra tokens, razonamiento, latencia, reintentos, errores y minutos de corrección humana.

Codex y clientes

La matriz actual de Codex enumera Astra para ChatGPT desktop, web, Codex CLI e IDE extension, pero no para Codex cloud. El rollout depende de la cuenta, el método de inicio de sesión, el plan, las políticas del workspace y la versión del cliente. Que una API key funcione en Responses no prueba que Codex autenticado con ChatGPT pueda seleccionar el modelo.

El catálogo OmniaKey marca Astra como compatible con Codex, Cursor, Cline y Aider. Usa el ID exacto y el mecanismo custom-provider documentado. Para separar problemas de API y cliente, consulta el compatibility kit.

Evaluación reproducible

Construye una prueba con una función determinista, un bug entre módulos, una tarea con herramientas y permisos, una tarea de recuperación en contexto largo y un documento o investigación con fuentes. Fija commit, prompt, herramientas, permisos, ID, effort y comando de aceptación. Compara Astra con Sol/Terra/Luna solo después de medir la línea base.

OpenAI comunica mejores resultados y menos tokens de salida como evidencia del proveedor, no como benchmark independiente universal. Un modelo barato solo gana si conserva el resultado aceptado y reduce el coste total de la tarea.

Veredicto

GPT-6 Astra merece ser la primera prueba para los flujos end-to-end más difíciles, pero no justifica reemplazar GPT-5.6 sin datos. Fija gpt-6-astra, empieza con low o medium, usa Responses para herramientas y verifica el cliente concreto. Con tarifas directas de OpenAI, mantén la entrada por debajo de 272K cuando sea posible; OmniaKey aplica una única tarifa baja en toda la ventana indicada. Decide con tareas aceptadas, reintentos y tiempo humano, no con un único precio por token.

Preguntas frecuentes

¿Astra sustituye GPT-5.6 Sol?

No automáticamente. Astra es el nuevo insignia y Sol es más barato; compara ambos con los mismos criterios, reintentos y correcciones.

¿Cuál es el ID exacto?

gpt-6-astra.

¿Cuál es el precio oficial?

Hasta 272K: $10 input, $1 cached input, $12.50 cache write y $50 output por MTok. Por encima, toda la petición usa $20, $2, $25 y $75.

¿Acepta imágenes?

Sí, entrada de texto e imagen y salida de texto. No se anuncian audio ni vídeo.

¿Las herramientas funcionan en Chat Completions?

El endpoint está disponible, pero la guía de Astra exige Responses para tool calling.

¿Está en Codex cloud?

La matriz actual no lo muestra para Codex cloud, aunque sí para desktop, web, CLI e IDE. Depende de la cuenta y el rollout.

Fuentes