GPT-6 Sol и Claude Opus 5.5 уже доступныGPT-6 Sol вдвое дешевле 5.6 Sol
Блог
Гайд

Обзор Claude Sonnet 5.5

Более быстрый рабочий модельный маршрут, но перед обновлением важнее проверить изменения API.

12 мин чтенияOmniaKey
Claude Sonnet 5.5Обзор моделиЦены APIClaude CodeМиграция

Стандартный прямой API Sonnet 5.5 стоит 2 USD за миллион входных и 10 USD за миллион выходных токенов. Чтение кэша — 0,20 USD за миллион. Ниже приведены расчёты задач; у подписок Claude и маршрутов OmniaKey свои условия оплаты.

Claude Sonnet 5.5 — практическое обновление для ежедневных задач в семействе Claude 5.5 от Anthropic. Модель вышла 28 сентября 2026 года. Стандартная цена токенов осталась такой же, как у Sonnet 5, но Anthropic заявляет ускорение генерации более чем на 30% и снижение стоимости задачи до 30% благодаря меньшему числу токенов. Опубликованные результаты в программировании и работе со знаниями также приблизились к Opus 5.5.

Это не означает, что Sonnet 5.5 заменяет Opus во всех сценариях. Он лучше всего подходит для ограниченных по объёму функций, воспроизводимых ошибок, документов, таблиц и быстрых циклов агента. Для разработчика главный риск — контракт API: если клиент Sonnet 5 отключает thinking, принудительно вызывает инструменты, использует старый computer use или читает только content[0], одного изменения имени модели недостаточно.

Проверено 29 сентября 2026 года. Обзор опирается на анонс Anthropic и актуальную документацию Claude Platform. Бенчмарки, скорость и экономия — опубликованные Anthropic значения; независимый платный тест и измерение задержки не проводились. Примеры стоимости рассчитаны по прямому глобальному API при одинаковом количестве токенов.

Коротко о характеристиках

ПараметрClaude Sonnet 5.5
Дата выхода28 сентября 2026 года
ID Claude APIclaude-sonnet-5-5
Контекст1M токенов
Стандартный максимум вывода128K токенов
Ввод / вывод$2 / $10 за миллион токенов
Запись / чтение кэша$2.50 / $0.20 за миллион
ThinkingAdaptive по умолчанию
Effort по умолчаниюhigh
Сравнительная задержкаFast
Надёжный срез знанийИюнь 2026 года
Ввод и выводТекст и изображения → текст

Модель доступна в Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry и Claude Platform on AWS. На разных платформах ID может отличаться, поэтому перед продакшеном проверьте таблицу доступности. В синхронном Messages API доступны контекст 1M и вывод 128K; Batch API с указанным beta-заголовком поддерживает до 300K вывода.

Что изменилось по сравнению с Sonnet 5

Anthropic заявляет ускорение генерации более чем на 30% и снижение стоимости задачи до 30%. Цена каждого токена не уменьшилась: экономия появляется за счёт более короткого вывода и меньшего числа шагов с инструментами.

ОценкаSonnet 5.5Sonnet 5Что проверяет
Terminal-Bench 4.070,6%10,3%Многошаговое программирование в терминале
CursorBench 4.055,5%34,1%Неоднозначные задачи coding-агента
GDPval-AA v2.118441449Работа со знаниями в разных профессиях
AA-Briefcase v1.118111359Длинные задачи со знаниями
Humanity’s Last Exam64,5%54,9%Междисциплинарное рассуждение с инструментами
OSWorld 2.180,1% partial57,0% partialComputer use
Chartography61,6%15,6%Распознавание диаграмм

Это сигналы из условий теста, а не гарантия результата в вашем репозитории. CursorBench близок к 57,8% Opus 5.5, а GDPval — к его 1846, однако Anthropic по-прежнему считает Opus сильнее в открытых задачах, требующих длительного суждения. Вывод: разрыв сократился на повторяемых задачах, но модель для эскалации всё ещё нужна.

На графиках стоимости Anthropic учитываются effort, инструменты и все токены задачи. При сравнении с страницей Opus 5.5 или текущим маршрутом Sonnet зафиксируйте prompt, права, commit, инструменты и тест приёмки.

Цены Sonnet 5.5: тарифы API на токены

Sonnet 5.5 использует прямой тариф Sonnet 5:

ПозицияЦена
Некэшированный ввод$2 / MTok
Вывод, включая оплачиваемые thinking-токены$10 / MTok
Запись кэша на 5 минут$2.50 / MTok
Запись кэша на 1 час$4 / MTok
Чтение кэша$0.20 / MTok
Batch APIскидка 50% на ввод и вывод

Стоимость задачи с Sonnet 5.5

Задача без кэша со 100K входных и 20K выходных токенов стоит 0.1 × $2 + 0.02 × $10 = $0.40. При 80K входных токенов из кэша расчёт будет 0.02 × $2 + 0.08 × $0.20 + 0.02 × $10 = $0.256, без первой записи кэша. Thinking, инструменты, повторы и число ходов меняют реальный счёт.

Поэтому «до 30% дешевле за задачу» не означает скидку 30% на каждый счёт. Считайте общую стоимость одной принятой правки после тестов или ревью. Тариф шлюза OmniaKey — отдельная поверхность; перед бюджетированием откройте актуальный каталог моделей.

Что проверить при миграции

Новый ID — claude-sonnet-5-5, но настройки Sonnet 5 нельзя бездумно перенести.

  1. Thinking по умолчанию Adaptive. Уберите поле thinking или используйте {"type":"adaptive"}. Чтобы отключить предварительное мышление, укажите thinking: {"type":"between_tools"}. Старое {"type":"disabled"} и ручной budget_tokens дают 400.
  2. Принудительный вызов инструмента не поддерживается. tool_choice с типом any или tool даёт 400. Используйте auto или none, а схему проверяйте через strict tools или structured outputs.
  3. Thinking blocks связаны с моделью и диалогом. Sonnet 5.5 читает блоки Sonnet 5, но Opus 5 и Opus 5.5 не читают блоки Sonnet 5.5. Смена модели посреди диалога меняет доступный контекст.
  4. Не редактируйте старую историю без проверки. Изменение system, tools или предыдущего сообщения и повторная отправка thinking block может вернуть 400 при новых проверках привязки. Добавляйте инструкции или используйте описанный механизм binding.
  5. Computer use зависит от платформы. Claude API и Google Cloud требуют computer_toolset_20260801; Bedrock по-прежнему принимает computer_20251124.
  6. Разбирайте поток по типу блока. Прогресс между инструментами может прийти как thinking. Клиент, который отображает только text, может выглядеть зависшим.

Минимальный запрос с адаптивным thinking:

json
{
  "model": "claude-sonnet-5-5",
  "max_tokens": 4096,
  "output_config": {"effort": "high"},
  "messages": [{"role": "user", "content": "Проверь этот план миграции и назови три главных риска."}]
}

Отдельно проверьте нестандартные temperature, top_p и top_k: текущий endpoint их отклоняет. В max_tokens нужно оставить место для размышления и видимого ответа.

Место в рабочем процессе

Начните с Sonnet 5.5 для ограниченной функции, воспроизводимой ошибки, тестов вокруг знакомого интерфейса, узкого code review, черновика документа или частых шагов агента. Тесты, typecheck, build и скриншоты быстро показывают, достаточно ли более дешёвой модели.

Повышайте effort или переходите к более сильной модели, если работа затрагивает несколько сервисов, требует труднообратимого архитектурного решения или не имеет важных данных. Если Sonnet получил правильные файлы и инструменты, но всё равно не нашёл причину, это ограничение способности. Если не хватило контекста, сначала исправьте контекст.

В Claude Code сравнивайте новые сессии с одинаковыми commit, prompt, правами и тестом приёмки. Записывайте время первого полезного результата, общее время, токены, повторы, ошибки инструментов и минуты ручной правки. Быстрый вывод токенов может потеряться на дополнительном ревью.

Итог

Claude Sonnet 5.5 стоит первым проверить для ежедневного программирования и работы со знаниями. Цена не выросла, скорость и опубликованные результаты улучшились, а у чётко ограниченных задач есть понятная причина уйти с Sonnet 5.

Не выкатывайте его заменой одной строки. Проверьте thinking, tool choice, парсер блоков и computer use. Opus 5.5 оставьте для неоднозначной архитектуры, сложной отладки и решений с высокой ценой ошибки. Для выбора между моделями пригодится сравнение Opus 5.5 и Sonnet 5.5.

Частые вопросы

Сколько стоит один запрос к Sonnet 5.5?

По прямому стандартному тарифу 100K входных токенов без кэша и 20K оплачиваемых выходных стоят 0,40 USD. Учитывайте рассуждения, запись кэша, инструменты и повторы. Отличие от лимита подписки объясняет руководство по ценам Claude Code.

Когда вышел Claude Sonnet 5.5?

28 сентября 2026 года. Прямой ID Claude API — claude-sonnet-5-5.

Он дешевле Sonnet 5?

Цена токенов та же: $2 за миллион входных, $10 за миллион выходных и $0.20 за миллион чтения кэша. Anthropic сообщает о снижении стоимости задачи до 30% благодаря меньшему потреблению.

Sonnet 5.5 лучше Opus 5.5?

Зависит от задачи. Sonnet быстрее и дешевле в ограниченной работе, Opus сильнее в сложном открытом суждении. Сравнивайте принятый результат, общую стоимость и исправления.

Можно ли отключить thinking?

Старое thinking: {"type":"disabled"} недопустимо. Используйте Adaptive или thinking: {"type":"between_tools"} на поддерживаемом уровне effort.

Контекст действительно 1M?

Да, стандартный максимум вывода — 128K. Это лимиты ёмкости, а не бесплатные или бесконечные кредиты.

Проверенные источники