DeepSeek V4 Flash уже доступна · Наша цена GLM-5.2 снижена до 50% от официальной
Блог
Гайд

Обзор GPT-6 Astra: что проверить перед миграцией

GPT-6 Astra — отдельная флагманская модель, а не новая семья Sol/Terra/Luna. Мы разделяем факты официального API, доступность Codex и экономику шлюза OmniaKey.

15 мин чтенияOmniaKey
GPT-6 AstraAPI pricingreasoningCodexmodel review

GPT-6 Astra предназначена для самых сложных сквозных задач: рассуждения, программирования, компьютерного управления, исследований и создания документов. Важная оговорка: это одна модель с одним API ID — gpt-6-astra, а не новая линейка из Sol, Terra и Luna.

Начинайте с Astra там, где ошибка, пропущенное ограничение или неудачный цикл инструментов обходятся дорого. GPT-5.6 Sol, Terra и Luna стоит оставить в маршрутизации, если они достигают той же приёмки дешевле. Сравнивайте модели на одном коммите, с одинаковыми инструментами, разрешениями и тестами.

Проверено 4 сентября 2026 года. Мы сверили официальные страницы OpenAI для модели, цен, latest-model, выбора модели и Codex, а также живую страницу маршрута OmniaKey. Независимый контролируемый benchmark не проводился; доступность аккаунта, клиента и шлюза может измениться.

Короткий ответ

ВопросПроверенный ответ
Точный IDgpt-6-astra
НазначениеСамая сложная сквозная работа с рассуждением, кодом, компьютером, исследованиями и документами
Контекст1 050 000 токенов; максимум input 922 000, output 128 000
МодальностиТекст и изображения на входе, текст на выходе
Effortlow, medium, high, xhigh, max; none не поддерживается
Standard OpenAI$10 input, $1 cached input, $12.50 cache write, $50 output за миллион токенов
Порог длинного контекстаПосле 272K весь запрос пересчитывается по длинному тарифу
OmniaKeyЖивой каталог содержит gpt-6-astra; это отдельная цена и граница доступа
Codex cloudВ текущей таблице Astra есть для desktop/web/CLI/IDE, но не для Codex cloud

Astra и GPT-5.6 — разные решения

OpenAI называет Astra самой способной моделью для сложной сквозной работы. Это позиционирование провайдера, а не независимый рейтинг каждого репозитория.

ПараметрGPT-6 AstraСемья GPT-5.6
Форма каталогаОдин флагманSol, Terra, Luna
IDgpt-6-astragpt-5.6-sol, gpt-5.6-terra, gpt-5.6-luna
РольСамая трудная end-to-end работаSol — сложная, Terra — баланс, Luna — объём и цена
Прямые Standard input/output$10 / $50Sol $4 / $20, Terra $2 / $12, Luna $0.20 / $1.20

Для выбора внутри GPT-5.6 используйте обзор GPT-5.6; эта статья посвящена Astra и миграционным проверкам.

Официальные характеристики

ХарактеристикаGPT-6 Astra
Модель и snapshotgpt-6-astra
Контекст1 050 000 токенов
Максимальный input / output922 000 / 128 000
Knowledge cutoff30 апреля 2026 года
Ввод / выводТекст, изображение / текст
Reasoning effortlow, medium, high, xhigh, max
Streaming, structured outputs, function callingПоддерживаются
Fine-tuningНе поддерживается

Окно включает историю, схемы инструментов, файлы, изображения, reasoning и ответ. Вместимость 1M не означает, что полный репозиторий без фильтра будет полезным или дешёвым.

Endpoint и инструменты

Страница модели перечисляет Chat Completions и Responses, но руководство миграции Astra уточняет: для tool calling нужен Responses. Для нового агентного кода начинайте с /v1/responses и проверяйте конкретный шлюз.

ПоверхностьСтатус
Chat CompletionsПоддерживается
ResponsesПоддерживается; рекомендуемый путь инструментов
BatchПоддерживается
Realtime, realtime translation/transcriptionНе поддерживаются
Assistants, legacy CompletionsНе поддерживаются
Fine-tuning, embeddings, moderationНе поддерживаются

В Responses OpenAI перечисляет web search, file search, image generation, code interpreter, hosted shell, Apply Patch, skills, computer use, MCP и tool search. Модель может выдать вызов, но приложение всё равно отвечает за права, sandbox, валидацию аргументов, таймауты и аудит побочных эффектов.

Новые примитивы включают асинхронные вызовы инструментов, mid-turn steering через WebSocket, смену effort через configuration_update и асинхронный misalignment monitoring. Это не отменяет границы доступа и ручное подтверждение опасных действий.

Reasoning и миграционные параметры

Astra не принимает none. Для старого клиента, который отправляет none или minimal, начните с low, затем сравните medium и high на той же выборке. Более высокий effort увеличивает работу и счёт, но не гарантирует правильность.

Reasoning-токены не видны в тексте, занимают контекст и тарифицируются как output. При слишком маленьком max_output_tokens ответ может стать incomplete ещё до видимого текста; проверяйте output_tokens_details.reasoning_tokens.

Официальные цены OpenAI

Все значения — USD за миллион токенов.

РежимInputCached inputCache writeOutput
Standard, до 272K$10.00$1.00$12.50$50.00
Standard, свыше 272K$20.00$2.00$25.00$75.00
Batch/Flex, до 272K$5.00$0.50$6.25$25.00
Batch/Flex, свыше 272K$10.00$1.00$12.50$37.50
Fast, до 272K$20.00$2.00$25.00$100.00
Fast, свыше 272K$40.00$4.00$50.00$150.00

Cache write стоит 1.25× обычного input. Batch и Flex стоят 50% Standard, Fast — 2×. OpenAI отдельно указывает, что Fast недоступен для Astra с EU data residency; региональная обработка может добавить 10%.

После 272K пересчитывается весь запрос. Например, 100K input + 10K output стоит 0.1 × $10 + 0.01 × $50 = $1.50, а 300K + 10K — 0.3 × $20 + 0.01 × $75 = $6.75. Это только токены: без инструментов, повторов, налогов и человеческого времени.

Цены OmniaKey

Живая страница OmniaKey содержит отдельный gateway quote:

Тариф OmniaKeyInputCache hitOutput
Всё указанное окно контекста$0.70$0.07$3.50

Для тех же примеров это около $0.105 и $0.245 соответственно. Это не официальная цена OpenAI. OmniaKey применяет этот нижний тариф ко всему указанному окну контекста и не добавляет второй тариф для более длинного ввода. Перед бюджетом откройте живую страницу Astra и каталог; доступ, failover и usage ledger принадлежат OmniaKey.

Prompt caching

Для GPT-6 и GPT-5.6+ документация OpenAI указывает:

  • минимум 1 024 видимых токена в кешируемом префиксе;
  • cache write 1.25× input, cache read 0.1× input;
  • prompt_cache_options.ttl: "30m" как поддерживаемый TTL;
  • явные breakpoints для стабильной части Prompt;
  • prompt_cache_key помогает маршрутизации, но не гарантирует hit.

Префикс в 100 000 токенов, записанный один раз и прочитанный один раз по короткому Standard-тарифу Astra, стоит 0.1 × $12.50 + 0.1 × $1.00 = $1.35, вместо 2 × 0.1 × $10.00 = $2.00 без кеша. Стабилизируйте инструкции и схемы инструментов, измеряйте cached_tokens, cache writes, latency и реальную стоимость. При миграции замените старый prompt_cache_retention на prompt_cache_options.ttl.

Чек-лист миграции

  1. Зафиксируйте model: "gpt-6-astra" в конфигурации и отчёте оценки.
  2. Для инструментов перейдите на Responses:
bash
curl https://api.omniakey.com/v1/responses \
  -H "Authorization: Bearer $OMNIAKEY_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"gpt-6-astra","reasoning":{"effort":"medium"},"input":"Проверьте план миграции и назовите два риска с тестами."}'
  1. Удалите temperature, top_p, top_logprobs; для Chat Completions также logprobs, а для Responses — message.output_text.logprobs из include.
  2. Замените none/minimal на low и сравните effort по одной acceptance set.
  3. Проверьте cache TTL, streaming termination, отмену, tool arguments, отказ в опасном действии и incomplete.
  4. Записывайте input/cache/reasoning/output tokens, latency, retries, provider errors и минуты ручной правки.

Codex и другие клиенты

Текущая страница Codex перечисляет Astra для ChatGPT desktop, web, Codex CLI и IDE extension, но не для Codex cloud. Доступ зависит от rollout, входа, плана, workspace policy и версии клиента. API key, который успешно вызывает Responses, не доказывает доступность модели в Codex с ChatGPT-входом.

Каталог OmniaKey сейчас указывает совместимость Astra с Codex, Cursor, Cline и Aider. Используйте точный ID и документированный custom-provider путь. Слой API и слой клиента проверяйте отдельно; для такой диагностики пригоден compatibility kit.

Как провести воспроизводимую проверку

Составьте набор из пяти реальных задач: детерминированная фича, межмодульный баг, tool-heavy workflow с разрешениями, длинный retrieval-контекст и документ/исследование с проверкой источников. Зафиксируйте commit, prompt, tools, permissions, ID, effort и команду приёмки. Сравнивайте Astra с Sol/Terra/Luna только после базового прогона.

Позиция OpenAI о более сильных результатах и меньшем числе output-токенов — vendor-reported evidence. Универсального независимого победителя здесь не заявляется. Дешёвая модель выигрывает только при эквивалентной принятой работе и меньшей полной стоимости.

Итог

GPT-6 Astra — разумная первая проверка для самых трудных сквозных задач, но не повод без измерений заменить весь GPT-5.6. Зафиксируйте gpt-6-astra, начните с low или medium, используйте Responses для инструментов и отдельно проверьте конкретный клиент. При прямом тарифе OpenAI держите input ниже 272K, когда это возможно; в OmniaKey нижний тариф действует на всём указанном окне контекста. Решение принимайте по принятой задаче, повторам и человеческому времени, а не по одному тарифу токенов.

Частые вопросы

Astra заменяет GPT-5.6 Sol?

Нет автоматического правила. Astra — более новый флагман, Sol дешевле; сравните их на одинаковой acceptance set с учётом повторов и ручной правки.

Какой точный ID?

gpt-6-astra.

Какова официальная цена?

До 272K: $10 input, $1 cached input, $12.50 cache write, $50 output за MTok. После порога весь запрос тарифицируется как $20, $2, $25 и $75.

Есть ли ввод изображений?

Да, текст и изображения на входе; выход — текст. Аудио и видео для Astra не заявлены.

Работают ли инструменты через Chat Completions?

Endpoint поддерживается, но руководство Astra требует Responses для tool calling.

Есть ли Astra в Codex cloud?

В текущей матрице Codex cloud не указан; desktop/web/CLI/IDE указаны. Доступ зависит от аккаунта и rollout.

Какой effort выбрать?

Начните с low или medium; none не поддерживается. Повышайте только по результатам тестов.

Источники