Обзор Claude Sonnet 5.5
Более быстрый рабочий модельный маршрут, но перед обновлением важнее проверить изменения API.
Стандартный прямой API Sonnet 5.5 стоит 2 USD за миллион входных и 10 USD за миллион выходных токенов. Чтение кэша — 0,20 USD за миллион. Ниже приведены расчёты задач; у подписок Claude и маршрутов OmniaKey свои условия оплаты.
Claude Sonnet 5.5 — практическое обновление для ежедневных задач в семействе Claude 5.5 от Anthropic. Модель вышла 28 сентября 2026 года. Стандартная цена токенов осталась такой же, как у Sonnet 5, но Anthropic заявляет ускорение генерации более чем на 30% и снижение стоимости задачи до 30% благодаря меньшему числу токенов. Опубликованные результаты в программировании и работе со знаниями также приблизились к Opus 5.5.
Это не означает, что Sonnet 5.5 заменяет Opus во всех сценариях. Он лучше всего подходит для ограниченных по объёму функций, воспроизводимых ошибок, документов, таблиц и быстрых циклов агента. Для разработчика главный риск — контракт API: если клиент Sonnet 5 отключает thinking, принудительно вызывает инструменты, использует старый computer use или читает только content[0], одного изменения имени модели недостаточно.
Проверено 29 сентября 2026 года. Обзор опирается на анонс Anthropic и актуальную документацию Claude Platform. Бенчмарки, скорость и экономия — опубликованные Anthropic значения; независимый платный тест и измерение задержки не проводились. Примеры стоимости рассчитаны по прямому глобальному API при одинаковом количестве токенов.
Коротко о характеристиках
| Параметр | Claude Sonnet 5.5 |
|---|---|
| Дата выхода | 28 сентября 2026 года |
| ID Claude API | claude-sonnet-5-5 |
| Контекст | 1M токенов |
| Стандартный максимум вывода | 128K токенов |
| Ввод / вывод | $2 / $10 за миллион токенов |
| Запись / чтение кэша | $2.50 / $0.20 за миллион |
| Thinking | Adaptive по умолчанию |
| Effort по умолчанию | high |
| Сравнительная задержка | Fast |
| Надёжный срез знаний | Июнь 2026 года |
| Ввод и вывод | Текст и изображения → текст |
Модель доступна в Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry и Claude Platform on AWS. На разных платформах ID может отличаться, поэтому перед продакшеном проверьте таблицу доступности. В синхронном Messages API доступны контекст 1M и вывод 128K; Batch API с указанным beta-заголовком поддерживает до 300K вывода.
Что изменилось по сравнению с Sonnet 5
Anthropic заявляет ускорение генерации более чем на 30% и снижение стоимости задачи до 30%. Цена каждого токена не уменьшилась: экономия появляется за счёт более короткого вывода и меньшего числа шагов с инструментами.
| Оценка | Sonnet 5.5 | Sonnet 5 | Что проверяет |
|---|---|---|---|
| Terminal-Bench 4.0 | 70,6% | 10,3% | Многошаговое программирование в терминале |
| CursorBench 4.0 | 55,5% | 34,1% | Неоднозначные задачи coding-агента |
| GDPval-AA v2.1 | 1844 | 1449 | Работа со знаниями в разных профессиях |
| AA-Briefcase v1.1 | 1811 | 1359 | Длинные задачи со знаниями |
| Humanity’s Last Exam | 64,5% | 54,9% | Междисциплинарное рассуждение с инструментами |
| OSWorld 2.1 | 80,1% partial | 57,0% partial | Computer use |
| Chartography | 61,6% | 15,6% | Распознавание диаграмм |
Это сигналы из условий теста, а не гарантия результата в вашем репозитории. CursorBench близок к 57,8% Opus 5.5, а GDPval — к его 1846, однако Anthropic по-прежнему считает Opus сильнее в открытых задачах, требующих длительного суждения. Вывод: разрыв сократился на повторяемых задачах, но модель для эскалации всё ещё нужна.
На графиках стоимости Anthropic учитываются effort, инструменты и все токены задачи. При сравнении с страницей Opus 5.5 или текущим маршрутом Sonnet зафиксируйте prompt, права, commit, инструменты и тест приёмки.
Цены Sonnet 5.5: тарифы API на токены
Sonnet 5.5 использует прямой тариф Sonnet 5:
| Позиция | Цена |
|---|---|
| Некэшированный ввод | $2 / MTok |
| Вывод, включая оплачиваемые thinking-токены | $10 / MTok |
| Запись кэша на 5 минут | $2.50 / MTok |
| Запись кэша на 1 час | $4 / MTok |
| Чтение кэша | $0.20 / MTok |
| Batch API | скидка 50% на ввод и вывод |
Стоимость задачи с Sonnet 5.5
Задача без кэша со 100K входных и 20K выходных токенов стоит 0.1 × $2 + 0.02 × $10 = $0.40. При 80K входных токенов из кэша расчёт будет 0.02 × $2 + 0.08 × $0.20 + 0.02 × $10 = $0.256, без первой записи кэша. Thinking, инструменты, повторы и число ходов меняют реальный счёт.
Поэтому «до 30% дешевле за задачу» не означает скидку 30% на каждый счёт. Считайте общую стоимость одной принятой правки после тестов или ревью. Тариф шлюза OmniaKey — отдельная поверхность; перед бюджетированием откройте актуальный каталог моделей.
Что проверить при миграции
Новый ID — claude-sonnet-5-5, но настройки Sonnet 5 нельзя бездумно перенести.
- Thinking по умолчанию Adaptive. Уберите поле
thinkingили используйте{"type":"adaptive"}. Чтобы отключить предварительное мышление, укажитеthinking: {"type":"between_tools"}. Старое{"type":"disabled"}и ручнойbudget_tokensдают 400. - Принудительный вызов инструмента не поддерживается.
tool_choiceс типомanyилиtoolдаёт 400. Используйтеautoилиnone, а схему проверяйте через strict tools или structured outputs. - Thinking blocks связаны с моделью и диалогом. Sonnet 5.5 читает блоки Sonnet 5, но Opus 5 и Opus 5.5 не читают блоки Sonnet 5.5. Смена модели посреди диалога меняет доступный контекст.
- Не редактируйте старую историю без проверки. Изменение system, tools или предыдущего сообщения и повторная отправка thinking block может вернуть 400 при новых проверках привязки. Добавляйте инструкции или используйте описанный механизм binding.
- Computer use зависит от платформы. Claude API и Google Cloud требуют
computer_toolset_20260801; Bedrock по-прежнему принимаетcomputer_20251124. - Разбирайте поток по типу блока. Прогресс между инструментами может прийти как
thinking. Клиент, который отображает толькоtext, может выглядеть зависшим.
Минимальный запрос с адаптивным thinking:
{
"model": "claude-sonnet-5-5",
"max_tokens": 4096,
"output_config": {"effort": "high"},
"messages": [{"role": "user", "content": "Проверь этот план миграции и назови три главных риска."}]
}
Отдельно проверьте нестандартные temperature, top_p и top_k: текущий endpoint их отклоняет. В max_tokens нужно оставить место для размышления и видимого ответа.
Место в рабочем процессе
Начните с Sonnet 5.5 для ограниченной функции, воспроизводимой ошибки, тестов вокруг знакомого интерфейса, узкого code review, черновика документа или частых шагов агента. Тесты, typecheck, build и скриншоты быстро показывают, достаточно ли более дешёвой модели.
Повышайте effort или переходите к более сильной модели, если работа затрагивает несколько сервисов, требует труднообратимого архитектурного решения или не имеет важных данных. Если Sonnet получил правильные файлы и инструменты, но всё равно не нашёл причину, это ограничение способности. Если не хватило контекста, сначала исправьте контекст.
В Claude Code сравнивайте новые сессии с одинаковыми commit, prompt, правами и тестом приёмки. Записывайте время первого полезного результата, общее время, токены, повторы, ошибки инструментов и минуты ручной правки. Быстрый вывод токенов может потеряться на дополнительном ревью.
Итог
Claude Sonnet 5.5 стоит первым проверить для ежедневного программирования и работы со знаниями. Цена не выросла, скорость и опубликованные результаты улучшились, а у чётко ограниченных задач есть понятная причина уйти с Sonnet 5.
Не выкатывайте его заменой одной строки. Проверьте thinking, tool choice, парсер блоков и computer use. Opus 5.5 оставьте для неоднозначной архитектуры, сложной отладки и решений с высокой ценой ошибки. Для выбора между моделями пригодится сравнение Opus 5.5 и Sonnet 5.5.
Частые вопросы
Сколько стоит один запрос к Sonnet 5.5?
По прямому стандартному тарифу 100K входных токенов без кэша и 20K оплачиваемых выходных стоят 0,40 USD. Учитывайте рассуждения, запись кэша, инструменты и повторы. Отличие от лимита подписки объясняет руководство по ценам Claude Code.
Когда вышел Claude Sonnet 5.5?
28 сентября 2026 года. Прямой ID Claude API — claude-sonnet-5-5.
Он дешевле Sonnet 5?
Цена токенов та же: $2 за миллион входных, $10 за миллион выходных и $0.20 за миллион чтения кэша. Anthropic сообщает о снижении стоимости задачи до 30% благодаря меньшему потреблению.
Sonnet 5.5 лучше Opus 5.5?
Зависит от задачи. Sonnet быстрее и дешевле в ограниченной работе, Opus сильнее в сложном открытом суждении. Сравнивайте принятый результат, общую стоимость и исправления.
Можно ли отключить thinking?
Старое thinking: {"type":"disabled"} недопустимо. Используйте Adaptive или thinking: {"type":"between_tools"} на поддерживаемом уровне effort.
Контекст действительно 1M?
Да, стандартный максимум вывода — 128K. Это лимиты ёмкости, а не бесплатные или бесконечные кредиты.