Цены Grok 4.6 API
xAI указывает $2 за миллион входных и $6 за миллион выходных токенов до порога 200K, после которого тарифы удваиваются.
Цены Grok 4.6 API зависят от длины prompt. xAI указывает $2 за миллион входных токенов и $6 за миллион выходных, пока prompt не превышает 200K токенов. При превышении 200K тариф становится $4 за вход и $12 за выход за миллион токенов. Для чтения кеша xAI указывает $0.50 и $1.00 за миллион токенов в этих двух режимах.
В текущем каталоге OmniAKey Grok 4.6 показан по тарифу длинного контекста: $3.20 вход, $9.60 выход и $0.80 чтение кеша за миллион токенов. Это цена платформы OmniAKey, а не новая официальная цена xAI. В бюджете держите эти отношения раздельно.
Цены и сведения о модели проверены 22 августа 2026 года. На официальной странице xAI grok-4.6 назван новейшей флагманской моделью с контекстом 500K и оплатой по использованию. Цифры OmniAKey взяты из текущего каталога и отражают коэффициент 80% для тарифа длинного контекста. Перед производственной покупкой проверьте обе страницы снова.
Цены Grok 4.6 API в одной таблице
Все значения указаны в USD за миллион токенов. Тариф длинного контекста применяется, когда prompt превышает 200K; первые 200K не становятся бесплатными.
| Использование | xAI до 200K | xAI выше 200K | Текущая цена OmniAKey* |
|---|---|---|---|
| Вход | $2.00 | $4.00 | $3.20 |
| Чтение кеша | $0.50 | $1.00 | $0.80 |
| Выход | $6.00 | $12.00 | $9.60 |
* Каталог OmniAKey сейчас показывает тариф длинного контекста. Это отдельная цена шлюза, которая может измениться независимо от прямого аккаунта xAI.
Общая формула:
стоимость = вход_без_кеша_в_миллионах × тариф_входа
+ чтение_кеша_в_миллионах × тариф_кеша
+ выход_в_миллионах × тариф_выхода
Страница Grok 4.6 владеет текущей ценой OmniAKey, ID модели, окном контекста, возможностями и примером запроса. Перед бюджетированием откройте живой каталог моделей.
Эта таблица охватывает только оплату токенов модели. В неё не входят налоги, конвертация валюты, отдельные сборы за файлы или инструменты, конечные точки генерации изображений и голоса/видео, а также условия корпоративного договора. Текущие метаданные xAI не показывают скидку Batch для Grok 4.6, поэтому не считайте, что перенос задания в Batch автоматически снизит тариф за токены.
Что меняется после 200K токенов prompt
Порог относится к prompt, отправленному модели. Это не то же самое, что максимальное окно 500K, и не месячная квота аккаунта. Файлы репозитория, схемы инструментов, история диалога и системные инструкции агента могут перевести запрос в дорогой режим даже при коротком финальном ответе.
Практические выводы:
- 500K означает вместимость запроса, а не бесплатные токены;
- повторение большого префикса репозитория может пересекать порог на каждом ходе;
- выход оплачивается отдельно, поэтому рассуждения, повторы патчей и циклы инструментов важны;
- чтение кеша уменьшает строку входа, но не делает выход бесплатным;
- у OmniAKey собственная цена, поэтому тарифный переключатель xAI нельзя автоматически применять к балансу шлюза.
Если клиент показывает статистику токенов, записывайте размер prompt до запроса и сверяйте его с usage после ответа. Размер файла или число символов не заменяют подсчёт токенов.
На границе тарифных уровней ориентируйтесь на такую схему:
| Размер prompt | Уровень xAI | Вход / чтение кеша / выход |
|---|---|---|
| Ровно 200 000 токенов | Стандартный | $2 / $0.50 / $6 за 1M |
| От 200 001 до 500 000 токенов | Длинный контекст | $4 / $1 / $12 за 1M |
| Выше указанного лимита prompt 500K | Не поддерживается текущими метаданными | Проверьте актуальную страницу модели |
В текущих метаданных модели 500K указано как максимальная длина prompt; это не обещание, что prompt на 500K сможет дополнительно получить неограниченный ответ. Возле любого порога сверяйте поля токенов у провайдера и итоговый счёт, а не оценку по числу символов.
Три воспроизводимых примера стоимости
Примеры используют опубликованные тарифы xAI и не включают налоги, конвертацию валют, отдельные media-расходы и будущие изменения цены.
Пример 1: обычный coding-запрос
Пусть запрос использует 100 000 входных токенов без кеша и создаёт 20 000 выходных токенов. Порог не пересечён.
| Маршрут | Расчёт | Итого |
|---|---|---|
| Стандартный xAI | 0.1 × $2 + 0.02 × $6 | $0.32 |
| Текущая цена OmniAKey | 0.1 × $3.20 + 0.02 × $9.60 | $0.512 |
Число OmniAKey использует текущую цену длинного контекста каталога, даже хотя пример меньше 200K. Перед планированием подтвердите живой тариф шлюза.
Пример 2: контекст целого репозитория
Пусть запрос содержит 300 000 входных токенов без кеша и создаёт 40 000 выходных токенов.
| Маршрут | Расчёт | Итого |
|---|---|---|
| Длинный контекст xAI | 0.3 × $4 + 0.04 × $12 | $1.68 |
| Текущая цена OmniAKey | 0.3 × $3.20 + 0.04 × $9.60 | $1.344 |
Длинный контекст заметно повышает стоимость. Сначала удалите повторяющийся вывод инструментов, старую историю и нерелевантные файлы.
Пример 3: повторный контекст в кеше
Пусть 300 000 токенов провайдер отчитает как чтение кеша, а ответ содержит 40 000 выходных токенов.
| Маршрут | Расчёт | Итого |
|---|---|---|
| Длинный контекст, кеш xAI | 0.3 × $1 + 0.04 × $12 | $0.78 |
| Текущая цена OmniAKey | 0.3 × $0.80 + 0.04 × $9.60 | $0.624 |
Расчёт действителен только при фактическом отчёте о cache read. Похожий текст или изменённый префикс может стать cache miss.
Чтение кеша не означает бесплатный prompt
Тариф кеша xAI снижает цену подходящего повторного ввода, но не превращает контекст в подписочную квоту. Решение о повторном использовании принимает клиент и провайдер, а источником истины остаётся usage.
Для coding-agent хорошими кандидатами на стабильный префикс являются system-инструкции, схемы инструментов, правила репозитория и неизменная вводная проекта. Меняющуюся задачу размещайте после этого префикса, если клиент позволяет управлять порядком.
Раздельно записывайте:
- входные токены без кеша;
- токены чтения кеша;
- выходные токены, включая reasoning, если он указан в API;
- повторы и неудачные ходы инструментов;
- результат принятой задачи.
Кеш, который экономит на входе, но создаёт устаревшие инструкции и новые повторы, может увеличить стоимость готовой задачи.
Для чего предназначен Grok 4.6
xAI описывает Grok 4.6 как новую флагманскую модель для программирования, долгих агентов, вызова инструментов и интерактивной или визуальной работы. На официальной API-странице указаны:
- ID модели
grok-4.6; - контекст 500K;
- vision и структурированный tool use;
- OpenAI-совместимый и нативный xAI-пути;
- оплата по использованию, prepaid credits и enterprise invoicing.
Это задокументированные возможности, а не независимый benchmark. Надёжность инструментов, задержка, отказы и стоимость принятой задачи зависят от клиента, прав, prompt и нагрузки.
Для широкого выбора модели используйте руководство по моделям для coding-agent. Эта статья отвечает на более узкий вопрос о бюджете Grok 4.6 API.
Grok 4.6 и Grok 4.5 в бюджете
Обе модели есть в каталоге OmniAKey и обе имеют окно 500K. Текущее сравнение для длинного контекста:
| Модель | Вход / чтение кеша / выход xAI | Текущая цена OmniAKey* |
|---|---|---|
grok-4.6 | $4 / $1 / $12 | $3.20 / $0.80 / $9.60 |
grok-4.5 | $4 / $0.60 / $12 | $3.20 / $0.48 / $9.60 |
- В колонке OmniAKey применён текущий коэффициент 80% из каталога; он может измениться независимо. При сравнении только токенов различие — в чтении кеша: Grok 4.5 дешевле, когда провайдер действительно сообщает cache read. Это не доказывает меньшую стоимость принятого задания: сравнивайте точный ID, поведение, повторы и живую цену каталога.
Для честного теста зафиксируйте ревизию репозитория, system prompt, права инструментов, acceptance tests и максимальный output. Запишите:
- запрошенный и возвращённый ID;
- prompt, cache и output tokens;
- задержку и количество повторов;
- прохождение тестов без ручного ремонта;
- итоговую сумму.
Полезный показатель — стоимость принятой задачи:
стоимость принятой задачи = успешный запуск
+ неудачные повторы
+ время ручной правки
+ риск исправления
Вызов Grok 4.6 через OpenAI-совместимый маршрут
Создайте отдельный ключ в панели API-ключей, проверьте grok-4.6 в живом каталоге и вызовите endpoint:
curl https://api.omniakey.com/v1/chat/completions \
-H "Authorization: Bearer $OMNIAKEY_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "grok-4.6",
"messages": [{"role": "user", "content": "Проверьте этот план развёртывания на скрытые точки отказа."}],
"stream": true
}'
Используйте точный ID. API quick start описывает endpoint и авторизацию. После тестовой задачи сравните оценку клиента с панелью usage.
Бюджетные ограничения для coding-agent
Отдельные ключи для локальной работы, CI и общей автоматизации дают независимую атрибуцию, лимит и отзыв.
Практический порядок:
- Запустите одну задачу с ясным acceptance test.
- Запишите prompt, cache, output, повторы и общую стоимость.
- Удалите старый контекст и неограниченный вывод инструментов.
- Поставьте лимит выше обычного разброса успешных задач.
- Настройте сигнал на повторы и неожиданный ID.
- Увеличивайте лимит только после проверки стоимости принятой задачи.
Руководство по прозрачному биллингу показывает, как сверять модель, токены и оплату шлюза. Лимит уменьшает риск, но не потребление токенов.
Частые ошибки с ценой Grok 4.6
Считать 500K бесплатной квотой
Это максимальная вместимость запроса. Токены всё равно оплачиваются.
Применять $2 к prompt на 300K
Такой prompt уже в дорогом long-context tier xAI.
Считать, что шлюз повторяет тариф xAI
OmniaKey — отдельная биллинговая связь. Читайте живую цену каталога.
Считать каждый повтор cache hit
Низкая ставка применяется только к фактически отчитанному чтению кеша.
Сравнивать только цену токена
Повторы, задержка, сбои инструментов и ручная правка часто важнее тарифа.
Публиковать настоящий API-ключ
Используйте переменную окружения и отдельный ключ. Реальное значение не должно попадать в репозиторий, issue или benchmark-лог.
Частые вопросы
Сколько стоит Grok 4.6 API?
xAI указывает $2 input и $6 output за миллион токенов до 200K, а после превышения — $4 и $12. Cache read стоит $0.50 и $1.00 соответственно.
Какой ID модели Grok 4.6 API?
Используйте grok-4.6. Фиксация ID делает тесты и бюджеты воспроизводимыми.
Есть ли у Grok 4.6 бесплатные 500K токенов?
Нет. 500K — ёмкость контекста, а не бесплатный баланс.
Сколько стоит Grok 4.6 через OmniAKey?
Текущий каталог показывает $3.20 input, $0.80 cache read и $9.60 output за миллион токенов для long-context quote. Проверьте живую страницу перед покупкой.
Grok 4.6 всегда дешевле Claude или GPT?
Нет. Сравнивайте модель, prompt tier, кеш, повторы и стоимость принятой задачи. Общая методика есть в сравнении цен API провайдеров.
Можно ли использовать Grok 4.6 в coding-agent?
Да, если клиент поддерживает нужный OpenAI-совместимый или нативный xAI-протокол, а каталог отдаёт grok-4.6. Проверьте конфигурацию перед production.
Проверенные источники
- xAI API и цены
- Документация xAI по ценам
- Документация xAI по моделям
- Quickstart xAI
- Страница Grok 4.6 OmniAKey
- API quick start OmniAKey
Факты проверены 22 августа 2026 года. Тарифы xAI, кеш, пороги контекста, доступность шлюза и цены платформы могут измениться. Перед производственным бюджетом проверьте первичные источники и живой каталог OmniAKey.