Обзор GPT-6 Astra: что проверить перед миграцией
GPT-6 Astra — отдельная флагманская модель, а не новая семья Sol/Terra/Luna. Мы разделяем факты официального API, доступность Codex и экономику шлюза OmniaKey.
GPT-6 Astra предназначена для самых сложных сквозных задач: рассуждения, программирования, компьютерного управления, исследований и создания документов. Важная оговорка: это одна модель с одним API ID — gpt-6-astra, а не новая линейка из Sol, Terra и Luna.
Начинайте с Astra там, где ошибка, пропущенное ограничение или неудачный цикл инструментов обходятся дорого. GPT-5.6 Sol, Terra и Luna стоит оставить в маршрутизации, если они достигают той же приёмки дешевле. Сравнивайте модели на одном коммите, с одинаковыми инструментами, разрешениями и тестами.
Проверено 4 сентября 2026 года. Мы сверили официальные страницы OpenAI для модели, цен, latest-model, выбора модели и Codex, а также живую страницу маршрута OmniaKey. Независимый контролируемый benchmark не проводился; доступность аккаунта, клиента и шлюза может измениться.
Короткий ответ
| Вопрос | Проверенный ответ |
|---|---|
| Точный ID | gpt-6-astra |
| Назначение | Самая сложная сквозная работа с рассуждением, кодом, компьютером, исследованиями и документами |
| Контекст | 1 050 000 токенов; максимум input 922 000, output 128 000 |
| Модальности | Текст и изображения на входе, текст на выходе |
| Effort | low, medium, high, xhigh, max; none не поддерживается |
| Standard OpenAI | $10 input, $1 cached input, $12.50 cache write, $50 output за миллион токенов |
| Порог длинного контекста | После 272K весь запрос пересчитывается по длинному тарифу |
| OmniaKey | Живой каталог содержит gpt-6-astra; это отдельная цена и граница доступа |
| Codex cloud | В текущей таблице Astra есть для desktop/web/CLI/IDE, но не для Codex cloud |
Astra и GPT-5.6 — разные решения
OpenAI называет Astra самой способной моделью для сложной сквозной работы. Это позиционирование провайдера, а не независимый рейтинг каждого репозитория.
| Параметр | GPT-6 Astra | Семья GPT-5.6 |
|---|---|---|
| Форма каталога | Один флагман | Sol, Terra, Luna |
| ID | gpt-6-astra | gpt-5.6-sol, gpt-5.6-terra, gpt-5.6-luna |
| Роль | Самая трудная end-to-end работа | Sol — сложная, Terra — баланс, Luna — объём и цена |
| Прямые Standard input/output | $10 / $50 | Sol $4 / $20, Terra $2 / $12, Luna $0.20 / $1.20 |
Для выбора внутри GPT-5.6 используйте обзор GPT-5.6; эта статья посвящена Astra и миграционным проверкам.
Официальные характеристики
| Характеристика | GPT-6 Astra |
|---|---|
| Модель и snapshot | gpt-6-astra |
| Контекст | 1 050 000 токенов |
| Максимальный input / output | 922 000 / 128 000 |
| Knowledge cutoff | 30 апреля 2026 года |
| Ввод / вывод | Текст, изображение / текст |
| Reasoning effort | low, medium, high, xhigh, max |
| Streaming, structured outputs, function calling | Поддерживаются |
| Fine-tuning | Не поддерживается |
Окно включает историю, схемы инструментов, файлы, изображения, reasoning и ответ. Вместимость 1M не означает, что полный репозиторий без фильтра будет полезным или дешёвым.
Endpoint и инструменты
Страница модели перечисляет Chat Completions и Responses, но руководство миграции Astra уточняет: для tool calling нужен Responses. Для нового агентного кода начинайте с /v1/responses и проверяйте конкретный шлюз.
| Поверхность | Статус |
|---|---|
| Chat Completions | Поддерживается |
| Responses | Поддерживается; рекомендуемый путь инструментов |
| Batch | Поддерживается |
| Realtime, realtime translation/transcription | Не поддерживаются |
| Assistants, legacy Completions | Не поддерживаются |
| Fine-tuning, embeddings, moderation | Не поддерживаются |
В Responses OpenAI перечисляет web search, file search, image generation, code interpreter, hosted shell, Apply Patch, skills, computer use, MCP и tool search. Модель может выдать вызов, но приложение всё равно отвечает за права, sandbox, валидацию аргументов, таймауты и аудит побочных эффектов.
Новые примитивы включают асинхронные вызовы инструментов, mid-turn steering через WebSocket, смену effort через configuration_update и асинхронный misalignment monitoring. Это не отменяет границы доступа и ручное подтверждение опасных действий.
Reasoning и миграционные параметры
Astra не принимает none. Для старого клиента, который отправляет none или minimal, начните с low, затем сравните medium и high на той же выборке. Более высокий effort увеличивает работу и счёт, но не гарантирует правильность.
Reasoning-токены не видны в тексте, занимают контекст и тарифицируются как output. При слишком маленьком max_output_tokens ответ может стать incomplete ещё до видимого текста; проверяйте output_tokens_details.reasoning_tokens.
Официальные цены OpenAI
Все значения — USD за миллион токенов.
| Режим | Input | Cached input | Cache write | Output |
|---|---|---|---|---|
| Standard, до 272K | $10.00 | $1.00 | $12.50 | $50.00 |
| Standard, свыше 272K | $20.00 | $2.00 | $25.00 | $75.00 |
| Batch/Flex, до 272K | $5.00 | $0.50 | $6.25 | $25.00 |
| Batch/Flex, свыше 272K | $10.00 | $1.00 | $12.50 | $37.50 |
| Fast, до 272K | $20.00 | $2.00 | $25.00 | $100.00 |
| Fast, свыше 272K | $40.00 | $4.00 | $50.00 | $150.00 |
Cache write стоит 1.25× обычного input. Batch и Flex стоят 50% Standard, Fast — 2×. OpenAI отдельно указывает, что Fast недоступен для Astra с EU data residency; региональная обработка может добавить 10%.
После 272K пересчитывается весь запрос. Например, 100K input + 10K output стоит 0.1 × $10 + 0.01 × $50 = $1.50, а 300K + 10K — 0.3 × $20 + 0.01 × $75 = $6.75. Это только токены: без инструментов, повторов, налогов и человеческого времени.
Цены OmniaKey
Живая страница OmniaKey содержит отдельный gateway quote:
| Тариф OmniaKey | Input | Cache hit | Output |
|---|---|---|---|
| Всё указанное окно контекста | $0.70 | $0.07 | $3.50 |
Для тех же примеров это около $0.105 и $0.245 соответственно. Это не официальная цена OpenAI. OmniaKey применяет этот нижний тариф ко всему указанному окну контекста и не добавляет второй тариф для более длинного ввода. Перед бюджетом откройте живую страницу Astra и каталог; доступ, failover и usage ledger принадлежат OmniaKey.
Prompt caching
Для GPT-6 и GPT-5.6+ документация OpenAI указывает:
- минимум 1 024 видимых токена в кешируемом префиксе;
- cache write 1.25× input, cache read 0.1× input;
prompt_cache_options.ttl: "30m"как поддерживаемый TTL;- явные breakpoints для стабильной части Prompt;
prompt_cache_keyпомогает маршрутизации, но не гарантирует hit.
Префикс в 100 000 токенов, записанный один раз и прочитанный один раз по короткому Standard-тарифу Astra, стоит 0.1 × $12.50 + 0.1 × $1.00 = $1.35, вместо 2 × 0.1 × $10.00 = $2.00 без кеша. Стабилизируйте инструкции и схемы инструментов, измеряйте cached_tokens, cache writes, latency и реальную стоимость. При миграции замените старый prompt_cache_retention на prompt_cache_options.ttl.
Чек-лист миграции
- Зафиксируйте
model: "gpt-6-astra"в конфигурации и отчёте оценки. - Для инструментов перейдите на Responses:
curl https://api.omniakey.com/v1/responses \
-H "Authorization: Bearer $OMNIAKEY_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"gpt-6-astra","reasoning":{"effort":"medium"},"input":"Проверьте план миграции и назовите два риска с тестами."}'
- Удалите
temperature,top_p,top_logprobs; для Chat Completions такжеlogprobs, а для Responses —message.output_text.logprobsизinclude. - Замените
none/minimalнаlowи сравните effort по одной acceptance set. - Проверьте cache TTL, streaming termination, отмену, tool arguments, отказ в опасном действии и
incomplete. - Записывайте input/cache/reasoning/output tokens, latency, retries, provider errors и минуты ручной правки.
Codex и другие клиенты
Текущая страница Codex перечисляет Astra для ChatGPT desktop, web, Codex CLI и IDE extension, но не для Codex cloud. Доступ зависит от rollout, входа, плана, workspace policy и версии клиента. API key, который успешно вызывает Responses, не доказывает доступность модели в Codex с ChatGPT-входом.
Каталог OmniaKey сейчас указывает совместимость Astra с Codex, Cursor, Cline и Aider. Используйте точный ID и документированный custom-provider путь. Слой API и слой клиента проверяйте отдельно; для такой диагностики пригоден compatibility kit.
Как провести воспроизводимую проверку
Составьте набор из пяти реальных задач: детерминированная фича, межмодульный баг, tool-heavy workflow с разрешениями, длинный retrieval-контекст и документ/исследование с проверкой источников. Зафиксируйте commit, prompt, tools, permissions, ID, effort и команду приёмки. Сравнивайте Astra с Sol/Terra/Luna только после базового прогона.
Позиция OpenAI о более сильных результатах и меньшем числе output-токенов — vendor-reported evidence. Универсального независимого победителя здесь не заявляется. Дешёвая модель выигрывает только при эквивалентной принятой работе и меньшей полной стоимости.
Итог
GPT-6 Astra — разумная первая проверка для самых трудных сквозных задач, но не повод без измерений заменить весь GPT-5.6. Зафиксируйте gpt-6-astra, начните с low или medium, используйте Responses для инструментов и отдельно проверьте конкретный клиент. При прямом тарифе OpenAI держите input ниже 272K, когда это возможно; в OmniaKey нижний тариф действует на всём указанном окне контекста. Решение принимайте по принятой задаче, повторам и человеческому времени, а не по одному тарифу токенов.
Частые вопросы
Astra заменяет GPT-5.6 Sol?
Нет автоматического правила. Astra — более новый флагман, Sol дешевле; сравните их на одинаковой acceptance set с учётом повторов и ручной правки.
Какой точный ID?
gpt-6-astra.
Какова официальная цена?
До 272K: $10 input, $1 cached input, $12.50 cache write, $50 output за MTok. После порога весь запрос тарифицируется как $20, $2, $25 и $75.
Есть ли ввод изображений?
Да, текст и изображения на входе; выход — текст. Аудио и видео для Astra не заявлены.
Работают ли инструменты через Chat Completions?
Endpoint поддерживается, но руководство Astra требует Responses для tool calling.
Есть ли Astra в Codex cloud?
В текущей матрице Codex cloud не указан; desktop/web/CLI/IDE указаны. Доступ зависит от аккаунта и rollout.
Какой effort выбрать?
Начните с low или medium; none не поддерживается. Повышайте только по результатам тестов.