DeepSeek V4 Flash уже доступна · Наша цена GLM-5.2 снижена до 50% от официальной
Блог
Контроль затрат

Цены Grok 4.6 API

xAI указывает $2 за миллион входных и $6 за миллион выходных токенов до порога 200K, после которого тарифы удваиваются.

12 мин чтенияOmniaKey
Grok 4.6API pricingxAIcoding cost

Цены Grok 4.6 API зависят от длины prompt. xAI указывает $2 за миллион входных токенов и $6 за миллион выходных, пока prompt не превышает 200K токенов. При превышении 200K тариф становится $4 за вход и $12 за выход за миллион токенов. Для чтения кеша xAI указывает $0.50 и $1.00 за миллион токенов в этих двух режимах.

В текущем каталоге OmniAKey Grok 4.6 показан по тарифу длинного контекста: $3.20 вход, $9.60 выход и $0.80 чтение кеша за миллион токенов. Это цена платформы OmniAKey, а не новая официальная цена xAI. В бюджете держите эти отношения раздельно.

Цены и сведения о модели проверены 22 августа 2026 года. На официальной странице xAI grok-4.6 назван новейшей флагманской моделью с контекстом 500K и оплатой по использованию. Цифры OmniAKey взяты из текущего каталога и отражают коэффициент 80% для тарифа длинного контекста. Перед производственной покупкой проверьте обе страницы снова.

Цены Grok 4.6 API в одной таблице

Все значения указаны в USD за миллион токенов. Тариф длинного контекста применяется, когда prompt превышает 200K; первые 200K не становятся бесплатными.

ИспользованиеxAI до 200KxAI выше 200KТекущая цена OmniAKey*
Вход$2.00$4.00$3.20
Чтение кеша$0.50$1.00$0.80
Выход$6.00$12.00$9.60

* Каталог OmniAKey сейчас показывает тариф длинного контекста. Это отдельная цена шлюза, которая может измениться независимо от прямого аккаунта xAI.

Общая формула:

text
стоимость = вход_без_кеша_в_миллионах × тариф_входа
          + чтение_кеша_в_миллионах × тариф_кеша
          + выход_в_миллионах × тариф_выхода

Страница Grok 4.6 владеет текущей ценой OmniAKey, ID модели, окном контекста, возможностями и примером запроса. Перед бюджетированием откройте живой каталог моделей.

Эта таблица охватывает только оплату токенов модели. В неё не входят налоги, конвертация валюты, отдельные сборы за файлы или инструменты, конечные точки генерации изображений и голоса/видео, а также условия корпоративного договора. Текущие метаданные xAI не показывают скидку Batch для Grok 4.6, поэтому не считайте, что перенос задания в Batch автоматически снизит тариф за токены.

Что меняется после 200K токенов prompt

Порог относится к prompt, отправленному модели. Это не то же самое, что максимальное окно 500K, и не месячная квота аккаунта. Файлы репозитория, схемы инструментов, история диалога и системные инструкции агента могут перевести запрос в дорогой режим даже при коротком финальном ответе.

Практические выводы:

  • 500K означает вместимость запроса, а не бесплатные токены;
  • повторение большого префикса репозитория может пересекать порог на каждом ходе;
  • выход оплачивается отдельно, поэтому рассуждения, повторы патчей и циклы инструментов важны;
  • чтение кеша уменьшает строку входа, но не делает выход бесплатным;
  • у OmniAKey собственная цена, поэтому тарифный переключатель xAI нельзя автоматически применять к балансу шлюза.

Если клиент показывает статистику токенов, записывайте размер prompt до запроса и сверяйте его с usage после ответа. Размер файла или число символов не заменяют подсчёт токенов.

На границе тарифных уровней ориентируйтесь на такую схему:

Размер promptУровень xAIВход / чтение кеша / выход
Ровно 200 000 токеновСтандартный$2 / $0.50 / $6 за 1M
От 200 001 до 500 000 токеновДлинный контекст$4 / $1 / $12 за 1M
Выше указанного лимита prompt 500KНе поддерживается текущими метаданнымиПроверьте актуальную страницу модели

В текущих метаданных модели 500K указано как максимальная длина prompt; это не обещание, что prompt на 500K сможет дополнительно получить неограниченный ответ. Возле любого порога сверяйте поля токенов у провайдера и итоговый счёт, а не оценку по числу символов.

Три воспроизводимых примера стоимости

Примеры используют опубликованные тарифы xAI и не включают налоги, конвертацию валют, отдельные media-расходы и будущие изменения цены.

Пример 1: обычный coding-запрос

Пусть запрос использует 100 000 входных токенов без кеша и создаёт 20 000 выходных токенов. Порог не пересечён.

МаршрутРасчётИтого
Стандартный xAI0.1 × $2 + 0.02 × $6$0.32
Текущая цена OmniAKey0.1 × $3.20 + 0.02 × $9.60$0.512

Число OmniAKey использует текущую цену длинного контекста каталога, даже хотя пример меньше 200K. Перед планированием подтвердите живой тариф шлюза.

Пример 2: контекст целого репозитория

Пусть запрос содержит 300 000 входных токенов без кеша и создаёт 40 000 выходных токенов.

МаршрутРасчётИтого
Длинный контекст xAI0.3 × $4 + 0.04 × $12$1.68
Текущая цена OmniAKey0.3 × $3.20 + 0.04 × $9.60$1.344

Длинный контекст заметно повышает стоимость. Сначала удалите повторяющийся вывод инструментов, старую историю и нерелевантные файлы.

Пример 3: повторный контекст в кеше

Пусть 300 000 токенов провайдер отчитает как чтение кеша, а ответ содержит 40 000 выходных токенов.

МаршрутРасчётИтого
Длинный контекст, кеш xAI0.3 × $1 + 0.04 × $12$0.78
Текущая цена OmniAKey0.3 × $0.80 + 0.04 × $9.60$0.624

Расчёт действителен только при фактическом отчёте о cache read. Похожий текст или изменённый префикс может стать cache miss.

Чтение кеша не означает бесплатный prompt

Тариф кеша xAI снижает цену подходящего повторного ввода, но не превращает контекст в подписочную квоту. Решение о повторном использовании принимает клиент и провайдер, а источником истины остаётся usage.

Для coding-agent хорошими кандидатами на стабильный префикс являются system-инструкции, схемы инструментов, правила репозитория и неизменная вводная проекта. Меняющуюся задачу размещайте после этого префикса, если клиент позволяет управлять порядком.

Раздельно записывайте:

  1. входные токены без кеша;
  2. токены чтения кеша;
  3. выходные токены, включая reasoning, если он указан в API;
  4. повторы и неудачные ходы инструментов;
  5. результат принятой задачи.

Кеш, который экономит на входе, но создаёт устаревшие инструкции и новые повторы, может увеличить стоимость готовой задачи.

Для чего предназначен Grok 4.6

xAI описывает Grok 4.6 как новую флагманскую модель для программирования, долгих агентов, вызова инструментов и интерактивной или визуальной работы. На официальной API-странице указаны:

  • ID модели grok-4.6;
  • контекст 500K;
  • vision и структурированный tool use;
  • OpenAI-совместимый и нативный xAI-пути;
  • оплата по использованию, prepaid credits и enterprise invoicing.

Это задокументированные возможности, а не независимый benchmark. Надёжность инструментов, задержка, отказы и стоимость принятой задачи зависят от клиента, прав, prompt и нагрузки.

Для широкого выбора модели используйте руководство по моделям для coding-agent. Эта статья отвечает на более узкий вопрос о бюджете Grok 4.6 API.

Grok 4.6 и Grok 4.5 в бюджете

Обе модели есть в каталоге OmniAKey и обе имеют окно 500K. Текущее сравнение для длинного контекста:

МодельВход / чтение кеша / выход xAIТекущая цена OmniAKey*
grok-4.6$4 / $1 / $12$3.20 / $0.80 / $9.60
grok-4.5$4 / $0.60 / $12$3.20 / $0.48 / $9.60
  • В колонке OmniAKey применён текущий коэффициент 80% из каталога; он может измениться независимо. При сравнении только токенов различие — в чтении кеша: Grok 4.5 дешевле, когда провайдер действительно сообщает cache read. Это не доказывает меньшую стоимость принятого задания: сравнивайте точный ID, поведение, повторы и живую цену каталога.

Для честного теста зафиксируйте ревизию репозитория, system prompt, права инструментов, acceptance tests и максимальный output. Запишите:

  • запрошенный и возвращённый ID;
  • prompt, cache и output tokens;
  • задержку и количество повторов;
  • прохождение тестов без ручного ремонта;
  • итоговую сумму.

Полезный показатель — стоимость принятой задачи:

text
стоимость принятой задачи = успешный запуск
                          + неудачные повторы
                          + время ручной правки
                          + риск исправления

Вызов Grok 4.6 через OpenAI-совместимый маршрут

Создайте отдельный ключ в панели API-ключей, проверьте grok-4.6 в живом каталоге и вызовите endpoint:

bash
curl https://api.omniakey.com/v1/chat/completions \
  -H "Authorization: Bearer $OMNIAKEY_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "grok-4.6",
    "messages": [{"role": "user", "content": "Проверьте этот план развёртывания на скрытые точки отказа."}],
    "stream": true
  }'

Используйте точный ID. API quick start описывает endpoint и авторизацию. После тестовой задачи сравните оценку клиента с панелью usage.

Бюджетные ограничения для coding-agent

Отдельные ключи для локальной работы, CI и общей автоматизации дают независимую атрибуцию, лимит и отзыв.

Практический порядок:

  1. Запустите одну задачу с ясным acceptance test.
  2. Запишите prompt, cache, output, повторы и общую стоимость.
  3. Удалите старый контекст и неограниченный вывод инструментов.
  4. Поставьте лимит выше обычного разброса успешных задач.
  5. Настройте сигнал на повторы и неожиданный ID.
  6. Увеличивайте лимит только после проверки стоимости принятой задачи.

Руководство по прозрачному биллингу показывает, как сверять модель, токены и оплату шлюза. Лимит уменьшает риск, но не потребление токенов.

Частые ошибки с ценой Grok 4.6

Считать 500K бесплатной квотой

Это максимальная вместимость запроса. Токены всё равно оплачиваются.

Применять $2 к prompt на 300K

Такой prompt уже в дорогом long-context tier xAI.

Считать, что шлюз повторяет тариф xAI

OmniaKey — отдельная биллинговая связь. Читайте живую цену каталога.

Считать каждый повтор cache hit

Низкая ставка применяется только к фактически отчитанному чтению кеша.

Сравнивать только цену токена

Повторы, задержка, сбои инструментов и ручная правка часто важнее тарифа.

Публиковать настоящий API-ключ

Используйте переменную окружения и отдельный ключ. Реальное значение не должно попадать в репозиторий, issue или benchmark-лог.

Частые вопросы

Сколько стоит Grok 4.6 API?

xAI указывает $2 input и $6 output за миллион токенов до 200K, а после превышения — $4 и $12. Cache read стоит $0.50 и $1.00 соответственно.

Какой ID модели Grok 4.6 API?

Используйте grok-4.6. Фиксация ID делает тесты и бюджеты воспроизводимыми.

Есть ли у Grok 4.6 бесплатные 500K токенов?

Нет. 500K — ёмкость контекста, а не бесплатный баланс.

Сколько стоит Grok 4.6 через OmniAKey?

Текущий каталог показывает $3.20 input, $0.80 cache read и $9.60 output за миллион токенов для long-context quote. Проверьте живую страницу перед покупкой.

Grok 4.6 всегда дешевле Claude или GPT?

Нет. Сравнивайте модель, prompt tier, кеш, повторы и стоимость принятой задачи. Общая методика есть в сравнении цен API провайдеров.

Можно ли использовать Grok 4.6 в coding-agent?

Да, если клиент поддерживает нужный OpenAI-совместимый или нативный xAI-протокол, а каталог отдаёт grok-4.6. Проверьте конфигурацию перед production.

Проверенные источники

Факты проверены 22 августа 2026 года. Тарифы xAI, кеш, пороги контекста, доступность шлюза и цены платформы могут измениться. Перед производственным бюджетом проверьте первичные источники и живой каталог OmniAKey.