Reseña de GPT-6 Astra: qué comprobar antes de migrar
GPT-6 Astra es un único modelo insignia, no una nueva familia Sol/Terra/Luna. Separamos los hechos de API, la disponibilidad en Codex y la economía del gateway OmniaKey.
GPT-6 Astra está pensado para el trabajo extremo de principio a fin: razonamiento, programación, uso del ordenador, investigación y creación de documentos. Es importante no confundirlo con otra familia: Astra es un único modelo con el ID gpt-6-astra, no una nueva versión de Sol, Terra y Luna.
Empieza con Astra cuando una decisión equivocada, una restricción perdida o un bucle de herramientas fallido sea caro. Conserva GPT-5.6 Sol, Terra y Luna cuando alcanzan el mismo criterio de aceptación a menor coste. La comparación debe usar el mismo commit, herramientas, permisos y pruebas, no solo una impresión del nombre de versión.
Verificado el 4 de septiembre de 2026. Comprobamos las páginas oficiales de OpenAI sobre el modelo, precios, latest-model, selección de modelos y Codex, además de la página de Astra en OmniaKey. No ejecutamos un benchmark independiente controlado; el acceso y el precio pueden cambiar.
Respuesta rápida
| Pregunta | Respuesta comprobada |
|---|---|
| ID exacto | gpt-6-astra |
| Uso principal | Razonamiento, código, ordenador, investigación y documentos de máxima dificultad |
| Contexto | 1.050.000 tokens; máximo de entrada 922.000 y salida 128.000 |
| Modalidades | Texto e imagen de entrada; texto de salida |
| Effort | low, medium, high, xhigh, max; none no está disponible |
| Precio Standard de OpenAI | $10 input, $1 cached input, $12.50 cache write y $50 output por millón |
| Regla de 272K | Al superar el umbral se repricinga toda la petición |
| OmniaKey | El catálogo activo incluye gpt-6-astra; es una tarifa y un acceso separados |
| Codex cloud | La matriz actual muestra desktop, web, CLI e IDE, pero no Codex cloud |
Astra frente a GPT-5.6
OpenAI describe Astra como su modelo más capaz para tareas complejas de extremo a extremo. Es posicionamiento del proveedor, no una clasificación independiente de todos los repositorios.
| Dimensión | GPT-6 Astra | Familia GPT-5.6 |
|---|---|---|
| Forma | Un modelo insignia | Sol, Terra y Luna |
| ID | gpt-6-astra | gpt-5.6-sol, gpt-5.6-terra, gpt-5.6-luna |
| Papel | Trabajo end-to-end más difícil | Sol difícil, Terra equilibrado, Luna repetible y económico |
| Input/output Standard | $10 / $50 | Sol $4 / $20, Terra $2 / $12, Luna $0.20 / $1.20 |
Para escoger dentro de GPT-5.6, consulta la reseña de GPT-5.6. Esta página cubre Astra y las comprobaciones de migración.
Especificaciones oficiales
| Especificación | GPT-6 Astra |
|---|---|
| Modelo y snapshot | gpt-6-astra |
| Ventana de contexto | 1.050.000 tokens |
| Máximo de entrada / salida | 922.000 / 128.000 |
| Corte de conocimiento | 30 de abril de 2026 |
| Entrada / salida | Texto, imagen / texto |
| Reasoning effort | low, medium, high, xhigh, max |
| Streaming, structured outputs, function calling | Compatibles |
| Fine-tuning | No compatible |
La ventana incluye historial, esquemas de herramientas, archivos, imágenes, tokens de razonamiento y salida. Que quepa un repositorio no significa que enviarlo completo sea útil ni barato.
Endpoints y herramientas
La página de Astra enumera Chat Completions y Responses. La guía de migración añade un límite importante: Chat Completions está disponible, pero el tool calling de Astra requiere Responses. Para agentes nuevos, empieza con /v1/responses y comprueba la ruta exacta del gateway.
| Capacidad | Estado |
|---|---|
| Chat Completions | Compatible |
| Responses | Compatible y recomendado para herramientas |
| Batch | Compatible |
| Realtime, traducción y transcripción realtime | No compatibles |
| Assistants y Completions legacy | No compatibles |
| Fine-tuning, embeddings y moderation | No compatibles |
En Responses, OpenAI lista web search, file search, image generation, code interpreter, hosted shell, Apply Patch, skills, computer use, MCP y tool search. El modelo puede emitir una llamada, pero tu aplicación conserva la autorización, el sandbox, la validación de argumentos, los timeouts y la revisión de efectos secundarios.
También aparecen llamadas asíncronas a herramientas, mid-turn steering por WebSocket, cambios de effort mediante configuration_update y monitorización asíncrona de desalineación. Son primitivas de flujo, no sustitutos de los límites de permisos y auditoría.
Reasoning y migración
Astra no admite none. Si el cliente antiguo envía none o minimal, empieza con low y compara medium y high usando el mismo conjunto de aceptación. Un effort mayor puede aumentar latencia y tokens facturados; no garantiza corrección.
Los tokens de razonamiento no aparecen en el texto, pero ocupan contexto y se facturan como salida. Con un max_output_tokens demasiado bajo, la respuesta puede quedar incomplete durante el razonamiento. Revisa output_tokens_details.reasoning_tokens y reserva presupuesto suficiente.
Precios oficiales de OpenAI
Valores en USD por millón de tokens.
| Procesamiento | Input | Cached input | Cache write | Output |
|---|---|---|---|---|
| Standard, hasta 272K | $10.00 | $1.00 | $12.50 | $50.00 |
| Standard, más de 272K | $20.00 | $2.00 | $25.00 | $75.00 |
| Batch/Flex, hasta 272K | $5.00 | $0.50 | $6.25 | $25.00 |
| Batch/Flex, más de 272K | $10.00 | $1.00 | $12.50 | $37.50 |
| Fast, hasta 272K | $20.00 | $2.00 | $25.00 | $100.00 |
| Fast, más de 272K | $40.00 | $4.00 | $50.00 | $150.00 |
Cache write cuesta 1,25× el input normal; Batch y Flex cuestan el 50% de Standard; Fast cuesta 2×. OpenAI indica que Fast no está disponible para Astra con EU data residency y que el procesamiento regional puede añadir 10%.
Superar 272.000 tokens de entrada cambia el precio de toda la petición. 100K de entrada + 10K de salida cuesta 0,1 × $10 + 0,01 × $50 = $1,50; 300K + 10K cuesta 0,3 × $20 + 0,01 × $75 = $6,75. Son cálculos de tokens sin herramientas, reintentos, impuestos ni tiempo humano.
Tarifas de OmniaKey
La página activa de OmniaKey muestra su propio gateway quote:
| Tarifa OmniaKey | Input | Cache hit | Output |
|---|---|---|---|
| Toda la ventana de contexto indicada | $0.70 | $0.07 | $3.50 |
Los dos ejemplos anteriores serían aproximadamente $0.105 y $0.245 en tokens. No son precios oficiales de OpenAI. OmniaKey mantiene esta tarifa baja en toda la ventana de contexto indicada y no añade un segundo tramo por entradas más largas. Antes de presupuestar, abre la página activa de Astra y el catálogo; el acceso, el failover y el ledger pertenecen a OmniaKey.
Prompt caching
La documentación de OpenAI para GPT-6 y GPT-5.6+ indica un prefijo visible mínimo de 1.024 tokens, cache write de 1,25×, cache read de 0,1× y prompt_cache_options.ttl: "30m". Los breakpoints explícitos evitan escribir sufijos variables; prompt_cache_key ayuda a dirigir tráfico, pero no garantiza un hit.
Un prefijo de 100.000 tokens escrito una vez y leído una vez con la tarifa Standard corta de Astra cuesta 0,1 × $12.50 + 0,1 × $1.00 = $1.35, frente a 2 × 0,1 × $10.00 = $2.00 sin caché. Mantén estables las instrucciones y los esquemas, y mide cached_tokens, cache writes, latencia y coste real. Al migrar, sustituye prompt_cache_retention por prompt_cache_options.ttl.
Lista de migración desde GPT-5.6
- Fija
model: "gpt-6-astra"en la configuración y los informes. - Usa Responses para herramientas:
curl https://api.omniakey.com/v1/responses \
-H "Authorization: Bearer $OMNIAKEY_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"gpt-6-astra","reasoning":{"effort":"medium"},"input":"Revisa este plan de migración y lista dos riesgos con pruebas de aceptación."}'
- Elimina
temperature,top_pytop_logprobs; en Chat Completions elimina tambiénlogprobs, y en Responses eliminamessage.output_text.logprobsdeinclude. - Cambia
none/minimalalowy compara los mismos casos enmediumyhigh. - Comprueba el TTL de caché, streaming, cancelación, argumentos de herramientas, efectos denegados e
incomplete. - Registra tokens, razonamiento, latencia, reintentos, errores y minutos de corrección humana.
Codex y clientes
La matriz actual de Codex enumera Astra para ChatGPT desktop, web, Codex CLI e IDE extension, pero no para Codex cloud. El rollout depende de la cuenta, el método de inicio de sesión, el plan, las políticas del workspace y la versión del cliente. Que una API key funcione en Responses no prueba que Codex autenticado con ChatGPT pueda seleccionar el modelo.
El catálogo OmniaKey marca Astra como compatible con Codex, Cursor, Cline y Aider. Usa el ID exacto y el mecanismo custom-provider documentado. Para separar problemas de API y cliente, consulta el compatibility kit.
Evaluación reproducible
Construye una prueba con una función determinista, un bug entre módulos, una tarea con herramientas y permisos, una tarea de recuperación en contexto largo y un documento o investigación con fuentes. Fija commit, prompt, herramientas, permisos, ID, effort y comando de aceptación. Compara Astra con Sol/Terra/Luna solo después de medir la línea base.
OpenAI comunica mejores resultados y menos tokens de salida como evidencia del proveedor, no como benchmark independiente universal. Un modelo barato solo gana si conserva el resultado aceptado y reduce el coste total de la tarea.
Veredicto
GPT-6 Astra merece ser la primera prueba para los flujos end-to-end más difíciles, pero no justifica reemplazar GPT-5.6 sin datos. Fija gpt-6-astra, empieza con low o medium, usa Responses para herramientas y verifica el cliente concreto. Con tarifas directas de OpenAI, mantén la entrada por debajo de 272K cuando sea posible; OmniaKey aplica una única tarifa baja en toda la ventana indicada. Decide con tareas aceptadas, reintentos y tiempo humano, no con un único precio por token.
Preguntas frecuentes
¿Astra sustituye GPT-5.6 Sol?
No automáticamente. Astra es el nuevo insignia y Sol es más barato; compara ambos con los mismos criterios, reintentos y correcciones.
¿Cuál es el ID exacto?
gpt-6-astra.
¿Cuál es el precio oficial?
Hasta 272K: $10 input, $1 cached input, $12.50 cache write y $50 output por MTok. Por encima, toda la petición usa $20, $2, $25 y $75.
¿Acepta imágenes?
Sí, entrada de texto e imagen y salida de texto. No se anuncian audio ni vídeo.
¿Las herramientas funcionan en Chat Completions?
El endpoint está disponible, pero la guía de Astra exige Responses para tool calling.
¿Está en Codex cloud?
La matriz actual no lo muestra para Codex cloud, aunque sí para desktop, web, CLI e IDE. Depende de la cuenta y el rollout.