DeepSeek V4 Flash уже доступна · Наша цена GLM-5.2 снижена до 50% от официальной
Блог
Контроль затрат

Цены API DeepSeek V4 Pro

Вне пиковых часов DeepSeek V4 Pro стоит $0.66 за миллион входных и $1.98 за миллион выходных токенов; в два ежедневных окна UTC ставки удваиваются до $1.32 и $3.96.

12 мин чтенияOmniaKey
DeepSeek V4 ProAPI pricing0813cost control

Новые цены API DeepSeek V4 Pro зависят от времени суток. При прямом доступе к API DeepSeek вне пиковых часов миллион токенов входа с попаданием в кеш стоит $0.022, входа без попадания в кеш - $0.66, а выхода - $1.98. В пиковые часы ставки удваиваются до $0.044, $1.32 и $3.96.

Снимок весов от 13 августа называется DeepSeek-V4-Pro-0813, но ID модели в API остается deepseek-v4-pro. Добавлять 0813 в запрос не нужно.

Проверено 18 августа 2026 года. DeepSeek выпустила V4 Pro 0813 13 августа, а новые тарифы по времени суток вступили в силу 16 августа в 16:00 UTC. Ниже указаны прямые тарифы API DeepSeek, а не обещание постоянной ставки OmniAKey. Перед утверждением производственного бюджета проверьте живой маршрут.

DeepSeek V4 Pro 0813: главное

ПараметрТекущее официальное значение
Веса / снимокDeepSeek-V4-Pro-0813
ID модели APIdeepseek-v4-pro
Дата выпуска13 августа 2026 года
Контекст1M токенов
Максимальный выход384K токенов
Режим рассуждения по умолчаниюВключен, уровень high
Уровни рассужденияlow, high или max
Нативные интерфейсыChat Completions, Responses API, Anthropic API
Вне пика: кеш / новый вход / выход$0.022 / $0.66 / $1.98
В пик: кеш / новый вход / выход$0.044 / $1.32 / $3.96
Пиковые окна01:00-04:00 и 06:00-10:00 UTC

Все цены указаны в долларах США за миллион токенов. Любое время вне двух перечисленных окон считается внепиковым и стоит вдвое дешевле пика.

Официальная таблица цен API DeepSeek V4 Pro

Тип использованияВне пикаВ пикМножитель
Вход с попаданием в кеш$0.022$0.0442x
Вход без попадания в кеш$0.66$1.322x
Выход$1.98$3.962x

Общая формула:

text
стоимость = миллионы кешированных входных токенов x ставка кеша
          + миллионы новых входных токенов x ставка нового входа
          + миллионы выходных токенов x ставка выхода

DeepSeek задает окна в UTC, но на странице цен не объясняет, как делится длинный запрос, пересекший границу. Ведите бюджет и журналы в UTC, считайте запись провайдера источником истины и уточните этот случай до запуска долгих задач рядом с границей.

Текущую цену OmniAKey, доступность и пример запроса показывает страница DeepSeek V4 Pro. Таблица выше описывает только прямой биллинг DeepSeek. Тариф шлюза и прямой тариф DeepSeek по времени суток относятся к разным расчетам, поэтому проверяйте живой каталог моделей, а не считайте их одинаковыми.

Что означает «0813»

DeepSeek-V4-Pro-0813 - загружаемый GA-снимок, который заменил V4 Pro Preview. Псевдоним размещенного API не изменился:

json
{
  "model": "deepseek-v4-pro"
}

Релиз сохраняет архитектуру Preview и добавляет модуль спекулятивного декодирования DSpark. DeepSeek также публикует веса по лицензии MIT. Для самостоятельного размещения это важно, но открытые веса не делают инференс бесплатным: оборудование, сервер, хранение и эксплуатация по-прежнему стоят денег.

Практические изменения для размещенного API:

  • более высокие результаты агентных тестов по отчету разработчика;
  • три явных уровня low, high и max;
  • нативная поддержка Responses API и оптимизация для Codex;
  • контекст 1M и рекомендуемый максимум выхода 384K для high и max;
  • новая пиковая и внепиковая сетка цен.

Постоянный псевдоним упрощает обновление, но хуже воспроизводится, чем фиксированный снимок весов. При сравнении записывайте дату запроса, ID API, уровень рассуждения, версию Harness и критерий приемки.

Пример 1: вход без попадания в кеш

Допустим, задача программирования использует 100 000 новых входных токенов и создает 20 000 выходных.

ПериодРасчет
Вне пика0.1 x $0.66 + 0.02 x $1.98 = $0.1056
В пик0.1 x $1.32 + 0.02 x $3.96 = $0.2112

Перенос того же объема токенов за пределы пиковых окон экономит $0.1056. Сам запрос не становится эффективнее: меняется только примененная ставка.

Пример 2: вход с попаданием в кеш

Теперь предположим, что те же 100 000 входных токенов попали в кеш, а модель снова создала 20 000 выходных.

ПериодРасчет
Вне пика0.1 x $0.022 + 0.02 x $1.98 = $0.0418
В пик0.1 x $0.044 + 0.02 x $3.96 = $0.0836

В этом примере выход формирует большую часть счета. Теплый префикс помогает, но длинные рассуждения, подробные ответы, циклы инструментов и повторы могут перекрыть экономию от кеша.

Как работает кеш контекста DeepSeek

DeepSeek по умолчанию включает дисковый кеш контекста. Более поздний запрос получает низкую ставку только тогда, когда его префикс полностью совпадает с сохраненной единицей кеш-префикса. Похожий текст или частично повторенный файл не гарантирует попадание.

Проверяйте поля usage в ответе:

  • prompt_cache_hit_tokens показывает входные токены по ставке попадания в кеш;
  • prompt_cache_miss_tokens показывает входные токены по ставке промаха.

Кеш работает по принципу best effort. Его создание занимает время, а неиспользуемые данные обычно удаляются через несколько часов или дней. Стройте бюджет по фактическим полям ответа, а не по ожидаемому повторному использованию.

Стабильные системные инструкции, схемы инструментов, правила репозитория и большие справочные документы хорошо подходят для кеширования. Если клиент позволяет управлять структурой, помещайте изменяемые инструкции после стабильного префикса.

Токены рассуждения оплачиваются как выход

Режим рассуждения включен по умолчанию на уровне high. DeepSeek сопоставляет OpenAI-уровни medium и xhigh с high; сама модель поддерживает low, high и max.

В Chat Completions передайте один из этих трех уровней через параметр reasoning_effort.

В Responses API расход рассуждения находится в usage.output_tokens_details.reasoning_tokens. Он входит в выходные токены, поэтому видимая длина ответа не дает полной оценки. Короткий итог может скрывать большой объем рассуждения.

Начинайте с low для простого извлечения и преобразования, используйте high для обычных агентных задач и тестируйте max только если рост доли принятых результатов окупает выход, задержку и стоимость. 384K - предел, а не рекомендуемое значение.

Для контроля контекста на уровне процесса откройте руководство по сокращению токенов. Сначала уберите устаревший контекст и неограниченный вывод инструментов, а затем решайте, нужен ли более слабый режим.

Как изменились результаты V4 Pro 0813

DeepSeek сообщает о следующих улучшениях относительно V4 Pro Preview:

ТестV4 Pro PreviewV4 Pro 0813
Terminal Bench 2.172.187.9
DeepSWE12.862.7
Toolathlon-Verified55.974.1
HLE с инструментами48.260.0

Источник: DeepSeek (vendor-reported; независимо не воспроизводилось). В публичных тестах code-agent компания использовала minimal-режим DeepSeek Harness, уровень max, temperature = 1.0 и top_p = 0.95. DSBench-FullStack и DSBench-Hard из той же таблицы являются внутренними наборами.

Эти числа показывают преимущество 0813 над Preview в конфигурации DeepSeek. Они не доказывают превосходство над каждой моделью, программой, кодовой базой или производственной задачей. Повторите характерную задачу с теми же входами, правами, инструментами и проверкой результата.

Установку и настройку собственного provider описывает руководство по DeepSeek Harness. Эта статья отвечает за цену и решение о версии 0813.

V4 Flash стоит в три раза дешевле

Ставки V4 Flash примерно втрое ниже ставок Pro. В показанной таблице новый вход и выход стоят ровно треть, а округленная ставка попадания в кеш немного ниже трети:

Использование V4 FlashВне пикаВ пик
Вход с попаданием в кеш$0.007$0.014
Вход без попадания в кеш$0.22$0.44
Выход$0.66$1.32

ID API - deepseek-v4-flash, текущий снимок - DeepSeek-V4-Flash-0731. Заявленный предел параллельности также выше: 2 500 у Flash против 500 у Pro.

Flash дешевле для первой проверки большого объема четко заданной работы. Это не доказывает одинаковое качество. Перед постоянной маршрутизацией сравните стоимость принятой задачи с повторами и временем исправлений.

Вызов DeepSeek V4 Pro через OmniAKey

Создайте ключ с отдельным лимитом в панели API Keys, убедитесь, что живой каталог содержит deepseek-v4-pro, и вызовите OpenAI-совместимый маршрут:

bash
curl https://api.omniakey.com/v1/chat/completions \
  -H "Authorization: Bearer $OMNIAKEY_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-v4-pro",
    "messages": [
      {"role": "user", "content": "Найди самое рискованное допущение в этом плане миграции."}
    ],
    "stream": true
  }'

Используйте точный ID из каталога шлюза. Быстрый старт API описывает адрес и аутентификацию.

После характерной задачи проверьте панель использования. Не применяйте прямую пиковую таблицу DeepSeek к записи OmniAKey, если живой тариф OmniAKey явно не указывает такое правило.

Сверку модели, токенов, кеша и стоимости каждого вызова объясняет руководство по прозрачному биллингу.

Практическая политика расписания и бюджета

Рабочий порядок:

  1. Для пользовательских и срочных задач приоритетом остается задержка; не откладывайте их только ради скидки.
  2. При прямом DeepSeek переносите пакетные оценки, индексацию и повторяемый ночной анализ за пределы 01:00-04:00 и 06:00-10:00 UTC.
  3. Отдельно записывайте попадания, промахи, рассуждение и выход.
  4. Создавайте отдельный лимит для человека, среды или роли автоматизации.
  5. Сравнивайте Pro и Flash по одному критерию принятой задачи.
  6. Перед сменой производственного расписания заново проверьте официальную страницу цен.

Лимит расходов ограничивает риск, но не уменьшает токены. Сначала оптимизируйте запрос, затем задайте предел с запасом на нормальную вариативность.

Частые ошибки в ценах DeepSeek V4 Pro

Отправлять DeepSeek-V4-Pro-0813 как ID API

Это имя снимка весов. В размещенном API используется deepseek-v4-pro.

Считать все часы внепиковыми

Пиковая цена действует 01:00-04:00 и 06:00-10:00 UTC. Остальные 17 часов используют тариф вдвое ниже.

Считать любой повтор кешем

Запрос должен полностью совпасть с сохраненной единицей префикса. Доверяйте prompt_cache_hit_tokens, а не внешнему сходству.

Принимать 1M контекста или 384K выхода за бесплатный пакет

Это пределы емкости. Токены внутри этих окон по-прежнему оплачиваются.

Не учитывать скрытое рассуждение

Токены рассуждения входят в выход. Короткий видимый ответ не всегда означает мало выходных токенов.

Выдавать тесты разработчика за независимые

Рост 0813 - vendor-reported результат с раскрытыми Harness и max настройками. Это сигнал к обновлению, а не универсальный рейтинг.

Частые вопросы

Сколько стоит API DeepSeek V4 Pro?

Вне пика DeepSeek берет $0.022 за миллион входных токенов с попаданием в кеш, $0.66 без попадания и $1.98 за выход. Пиковые ставки составляют $0.044, $1.32 и $3.96.

Когда действует внепиковый тариф?

Любое время UTC, кроме 01:00-04:00 и 06:00-10:00. Внепиковые ставки на 50% ниже пиковых.

Какой ID API у DeepSeek V4 Pro 0813?

Используйте deepseek-v4-pro. DeepSeek-V4-Pro-0813 обозначает опубликованные веса и снимок, а не ID запроса размещенного API.

Поддерживает ли DeepSeek V4 Pro миллион токенов?

Да. DeepSeek указывает контекст 1M и максимальный выход 384K. Это ограничения, а не бесплатные квоты.

DeepSeek V4 Pro дешевле V4 Flash?

Нет. Указанные ставки Flash примерно втрое ниже Pro в обоих периодах. Pro должен окупить надбавку более высокой долей принятых задач.

Улучшила ли версия 0813 работу code-agent?

DeepSeek сообщает о крупных улучшениях над Pro Preview в Terminal Bench 2.1, DeepSWE и Toolathlon-Verified. Публичные запуски использовали DeepSeek Harness minimal и max. До повторения на вашей работе считайте их vendor-reported результатами.

Проверенные источники

Факты проверены 18 августа 2026 года. Цены, пиковые окна, псевдонимы, доступность шлюза и функции могут измениться. Перед производственным бюджетом проверьте первичные источники и живой каталог.