DeepSeek V4 Flash ya está disponible · Nuestro precio de GLM-5.2 baja al 50% del oficial
Blog
Configuración API

Cómo usar GPT-6 Astra con OmniaKey

Crea una clave, prueba Responses API y conecta Python, Node.js o Codex.

8 min de lecturaOmniaKey
GPT-6 AstraResponses APIOpenAI SDKCodexAPI setup

Este tutorial te lleva desde una cuenta nueva de OmniaKey hasta una petición correcta a GPT-6 Astra. Cubre llamadas de API desde el servidor y Codex CLI. Una clave API de OmniaKey no es una suscripción de ChatGPT y no se puede introducir en la web de ChatGPT.

Usa estos valores exactos: modelo gpt-6-astra, Base URL https://api.omniakey.com/v1 y endpoint Responses POST /v1/responses. Empieza con reasoning.effort en medium.

La guía actual de OpenAI para Astra empieza con Responses API. Chat Completions sigue disponible para texto normal, pero las herramientas de Astra requieren Responses. Los ejemplos respetan ese límite y leen la clave desde una variable de entorno.

Antes de empezar

Crea una clave API limitada

Inicia sesión en OmniaKey y abre la página API Keys. Crea una clave separada para esta integración y define una cuota y una caducidad adecuadas para la prueba. Copia la clave cuando aparezca.

La cuenta también necesita saldo disponible. Crear una clave demuestra que la credencial existe, pero no que la cuenta pueda pagar una petición.

Trata la clave como una contraseña. No la subas a Git, no la incluyas en JavaScript del navegador, capturas de pantalla ni mensajes.

Guarda la clave en el entorno

En macOS o Linux:

bash
export OMNIAKEY_API_KEY="your-omniakey-api-key"

En PowerShell:

powershell
$env:OMNIAKEY_API_KEY="your-omniakey-api-key"

Los ejemplos de SDK y Codex leen la misma variable.

Haz la primera petición con Responses API

Ejecuta en una terminal:

bash
curl https://api.omniakey.com/v1/responses \
  -H "Authorization: Bearer $OMNIAKEY_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-6-astra",
    "reasoning": {"effort": "medium"},
    "input": "Revisa este plan de migración. Devuelve los dos riesgos principales y una prueba de aceptación para cada uno."
  }'

Una respuesta correcta contiene el array output, texto generado y uso de tokens. Esta única llamada comprueba Base URL, clave, saldo, permiso del modelo, ID y ruta Responses.

Después abre el panel de uso y confirma que el modelo registrado es gpt-6-astra. Revisa input, cached input, reasoning y output reales en vez de estimar el coste por la longitud del texto visible.

Llama a Astra desde Python

Instala o actualiza el SDK oficial de OpenAI para Python:

bash
python -m pip install --upgrade openai

Crea astra_example.py:

python
import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["OMNIAKEY_API_KEY"],
    base_url="https://api.omniakey.com/v1",
)

response = client.responses.create(
    model="gpt-6-astra",
    reasoning={"effort": "medium"},
    input="Explica este informe de incidente y enumera las tres comprobaciones siguientes más útiles.",
)

print(response.output_text)

Ejecuta:

bash
python astra_example.py

response.output_text es el campo cómodo del SDK para el texto generado. Conserva la respuesta completa si también necesitas usage, status o elementos de tool call.

Llama a Astra desde Node.js

Instala el SDK:

bash
npm install openai

Crea un archivo de servidor llamado astra-example.mjs:

javascript
import OpenAI from "openai";

const apiKey = process.env.OMNIAKEY_API_KEY;
if (!apiKey) throw new Error("OMNIAKEY_API_KEY is required");

const client = new OpenAI({
  apiKey,
  baseURL: "https://api.omniakey.com/v1",
});

const response = await client.responses.create({
  model: "gpt-6-astra",
  reasoning: { effort: "medium" },
  input: "Revisa este diseño de API. Detecta dos modos de fallo y una prueba para cada uno.",
});

console.log(response.output_text);

Ejecuta desde la terminal donde definiste la variable:

bash
node astra-example.mjs

Ejecuta este código en un servidor, equipo local o worker de confianza. Una clave incluida en un frontend queda expuesta a sus visitantes.

Usa GPT-6 Astra en Codex CLI

Codex utiliza el formato Responses mediante un provider personalizado. Añade esto a ~/.codex/config.toml:

toml
model = "gpt-6-astra"
model_provider = "omniakey"

[model_providers.omniakey]
name = "OmniaKey"
base_url = "https://api.omniakey.com/v1"
env_key = "OMNIAKEY_API_KEY"
wire_api = "responses"

Inicia Codex desde una terminal que tenga la clave:

bash
export OMNIAKEY_API_KEY="your-omniakey-api-key"
codex

No añadas requires_openai_auth = true a este provider. Ese modo usa la autenticación de una cuenta OpenAI y hace que Codex ignore el env_key del provider personalizado.

Comprueba primero el modelo que muestra Codex y ejecuta una tarea pequeña de solo lectura antes de permitir cambios. Si cURL funciona y Codex falla, revisa primero la configuración del cliente.

Usa Chat Completions solo cuando el cliente lo necesite

GPT-6 Astra acepta texto normal mediante Chat Completions. Utiliza esta ruta si el cliente aún no soporta Responses:

bash
curl https://api.omniakey.com/v1/chat/completions \
  -H "Authorization: Bearer $OMNIAKEY_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-6-astra",
    "reasoning_effort": "medium",
    "messages": [
      {"role": "user", "content": "Resume los dos riesgos principales de este plan de despliegue."}
    ]
  }'

Los parámetros son distintos: Responses usa reasoning.effort y Chat Completions usa reasoning_effort. No añadas herramientas de Astra a este ejemplo. La guía actual de OpenAI requiere Responses para tool calling.

Elige el reasoning effort

EffortCuándo empezar aquí
lowLa tarea está acotada, es fácil de verificar o necesita poca latencia
mediumEs la primera petición representativa
highHace falta más planificación o comprobar varios archivos
xhigh / maxUna prueba de aceptación medible sigue fallando con menos effort

Astra admite low, medium, high, xhigh y max, pero no none. Un effort mayor puede aumentar razonamiento, latencia y coste de output sin garantizar una respuesta correcta. Usa el valor mínimo que supere tu prueba de aceptación.

Dale a Astra una tarea verificable

Un primer prompt útil define objetivo, contexto, restricciones y criterio de finalización:

text
Objetivo: revisar el riesgo de desplegar esta migración de base de datos.
Contexto: PostgreSQL 15, un solo writer en producción y rollback en menos de cinco minutos.
Restricciones: no propongas comandos destructivos; separa hechos comprobados y supuestos.
Terminado cuando: devuelvas los tres riesgos principales, una mitigación y una prueba para cada uno.

Para programación, indica también las reglas del repositorio y el comando exacto que verifica el resultado. Astra sigue con atención los archivos de instrucciones disponibles, así que revisa AGENTS.md, skills y archivos similares antes de darle acceso a herramientas.

Soluciona los errores comunes

401, unauthorized o clave no válida

Confirma que OMNIAKEY_API_KEY está definida en la misma terminal que ejecuta el comando. La variable contiene solo la clave; Bearer pertenece al HTTP header. Comprueba que la clave está activa y no ha caducado.

Saldo o cuota insuficientes

Comprueba tanto el saldo de la cuenta como la cuota propia de la clave. Una cuenta con saldo puede fallar si la clave limitada alcanzó su máximo.

Modelo no encontrado o no disponible

Usa el ID exacto gpt-6-astra. Abre la página activa del modelo y confirma el permiso de la clave. Nombres como GPT 6 no son ID de API.

Parámetro no compatible

Elimina temperature, top_p y top_logprobs. En Chat Completions elimina también logprobs; en el include de Responses elimina message.output_text.logprobs. Astra no admite esos parámetros.

La respuesta es incomplete o no tiene texto visible

Aumenta max_output_tokens y revisa output_tokens_details.reasoning_tokens. Los tokens de razonamiento consumen el presupuesto de salida antes de terminar la respuesta visible.

El chat funciona, pero las herramientas fallan

Mueve el flujo a /v1/responses. Prueba primero texto normal y después añade una sola herramienta, verificando petición, resultado, timeout y permisos. La lista oficial de OpenAI describe la capacidad directa del modelo; un gateway o cliente puede exponer una superficie menor.

Codex sigue usando otro modelo

Revisa model, model_provider, base_url, env_key y wire_api en la configuración activa. Reinicia Codex desde la terminal donde está definida OMNIAKEY_API_KEY.

Verifica el coste antes de producción

Ejecuta una tarea representativa, comprueba el registro de uso e incluye los reintentos en el coste completo. La página activa de Astra contiene el precio actual de OmniaKey; la reseña de Astra lo separa de las tarifas directas de OpenAI y explica su umbral de 272K.

Referencias