GPT-6 Sol и Claude Opus 5.5 уже доступныGPT-6 Sol вдвое дешевле 5.6 Sol
Блог
Сравнение

Opus 5.5 или Sonnet 5.5

Выбирайте по результату и полной стоимости задачи.

11 мин чтенияOmniaKey
Claude Opus 5.5Claude Sonnet 5.5СравнениеПрограммированиеЦены API

Выбирать между Claude Opus 5.5 и Sonnet 5.5 стоит по принятому результату и полной стоимости задачи. Sonnet удобно взять за основу проверки ограниченных изменений, воспроизводимых ошибок и задач с тестами. Opus стоит оценить, если причина сбоя остаётся неясной, изменение затрагивает несколько систем или правдоподобная ошибка обернётся дорогой переделкой. Это стратегия оценки, а не универсальный рейтинг.

Стандартные входные и выходные токены Sonnet вдвое дешевле, но чтение кэша у моделей стоит одинаково. В опубликованных тестах программирования тоже нет победителя во всех дисциплинах.

Официальные источники проверены 29 сентября 2026 года. Собственное сравнительное тестирование не проводилось. Баллы приведены с указанием источников, а цены задач рассчитаны при фиксированном числе токенов: это не измеренные счета. OmniaKey публикует материал и предоставляет API-шлюз с отдельными тарифами.

Чем отличаются Opus 5.5 и Sonnet 5.5

Opus 5.5 вышел 22 сентября 2026 года, Sonnet 5.5 — 28 сентября. Сравнение с Sonnet 5 сохранено для предыдущей версии.

ПараметрSonnet 5.5Opus 5.5
ID в Claude APIclaude-sonnet-5-5claude-opus-5-5
Контекст / обычный максимум вывода1M / 128K токенов1M / 128K токенов
Вход → выходТекст и изображения → текстТекст и изображения → текст
Effort API по умолчаниюhighmedium
РассуждениеAdaptive; доступен between_toolsAdaptive, всегда включено
Категория задержки производителяFastModerate
Ввод / вывод за миллион токенов$2 / $10$4 / $20
Чтение кэша за миллион токенов$0.20$0.20

Источник: официальный обзор моделей. Одинаковый контекст не означает одинаковую точность поиска сведений. Ввод и вывод должны укладываться в общий допустимый бюджет. Вывод 300K — отдельная бета-возможность Batch API, а не обычный синхронный лимит.

Программирование: что показывают тесты

Цифры взяты из сравнительной таблицы анонса Sonnet 5.5. OmniaKey не повторяла эти измерения.

ОценкаSonnet 5.5Opus 5.5
Terminal-Bench 4.070.6% (max)66.4% (xhigh)
FrontierCode 1.1 Main46.2% (max); 52.1% (xhigh)54.4%
CursorBench 4.055.5%57.8%
GDPval-AA v2.118441846

В system card, §8.5, указаны 66 задач Terminal-Bench и пять попыток каждой: по 330 попыток на модель. При допущении независимости попыток стандартная ошибка составляет ±2,5 пункта для Sonnet и ±2,6 для Opus. Использовался Claude Code в режиме --bare, с защитными механизмами и резервными моделями для части запросов; доли затронутых попыток различаются. Разница 4,2 пункта не доказывает превосходство во всём программировании или статистическую значимость без дополнительных данных.

У Sonnet в FrontierCode результат max ниже, чем xhigh. В примечании к анонсу объясняется: более частый запуск процесса ревью в разобранных случаях приводил к таймауту или изменениям вне задания. Больше рассуждений не обязательно улучшает итоговый патч.

GDPval измеряется баллами, не процентами. Для результатов Sonnet в GDPval-AA и AA-Briefcase раскрыт также исправленный впоследствии баг структурированного вывода в предварительном развёртывании. Подробности версий — в обзорах Sonnet 5.5 и Opus 5.5.

Цены API и кэш

Это стандартные глобальные цены прямого API из тарифной документации, USD за миллион токенов. Налоги, инструменты, региональные условия и сборы других платформ не включены. Фиксированная цена в рублях здесь не предполагается.

КатегорияSonnet 5.5Opus 5.5
Некэшированный ввод$2$4
Оплачиваемый вывод$10$20
Запись кэша на 5 минут$2.50$5
Запись кэша на 1 час$4$8
Чтение кэша$0.20$0.20

Оплачиваемый вывод включает рассуждение. Минимальный кэшируемый prompt обеих моделей — 512 токенов, но попадание в кэш подтверждается полями usage. Ниже одинаковые объёмы, а не реальные измерения. Они могут суммироваться по нескольким запросам, каждый из которых соблюдает свои лимиты.

Одинаковая нагрузкаSonnet 5.5Opus 5.5
100K некэшированного ввода + 20K вывода$0.40$0.80
То же + первая запись 800K в кэш на 5 минут$2.40$4.80
100K некэшированного ввода + 800K действительного чтения кэша + 20K вывода$0.56$0.96

Последняя строка: Sonnet 0.1 × 2 + 0.8 × 0.20 + 0.02 × 10 = $0.56, Opus 0.1 × 4 + 0.8 × 0.20 + 0.02 × 20 = $0.96. На этапе чтения разница примерно в 1,71 раза; предварительная запись оплачивается отдельно. Не учитывайте записанные токены повторно как некэшированный ввод.

Реальные задачи расходуют разные объёмы и требуют разных повторов. Делите все расходы, включая неудачные попытки, на число принятых результатов. Время ручного исправления измеряйте отдельно, прежде чем переводить его в деньги по явно указанной ставке.

Скорость и настройки рассуждения

Заявления Sonnet 5.5 об ускорении вывода на 30%+ и снижении цены задачи до 30% относятся к сравнению с Sonnet 5. Это не разница с Opus 5.5 и не снижение тарифов API на 30%. Типичная экономия около 40%, заявленная для Opus 5.5, относится к Opus 5.

Sonnet по умолчанию использует high в API, но medium в Claude Code и приложениях. API Opus использует medium. Указывайте клиент и настройку: одинаковое название effort не означает одинаковый вычислительный бюджет. Время до первого полезного ответа и до проверенного завершения задачи — разные показатели.

Когда стоит переплачивать за Opus

Проверяйте Sonnet на ограниченных функциях, точечных ревью и структурированном извлечении данных. Для Opus полезны неоднозначные межсервисные ошибки, сложные миграции и долгие исследования. Одинаковые исходные данные и приёмка покажут, уменьшается ли переделка. Цена не гарантирует правильность или безопасность.

В длинных документах проверяйте ссылки и пропуски условий, в визуальных задачах — нужные скриншоты и графики. Понимание изображений не равно их нативной генерации. Наша рекомендация учитывает расходы; общий гайд Anthropic предлагает начинать большинство задач с Opus 5.5. Это разумно при приоритете качества. Более широкий выбор описан в гайде моделей для Claude Code.

Перед сменой модели

Прочитайте руководства по миграции Sonnet и Opus. between_tools у Sonnet при high или ниже убирает предварительное рассуждение, но не все его формы. Opus сохраняет adaptive thinking.

Обе модели отклоняют принудительный tool_choice типов any и tool. Строгая валидация аргументов не заставляет вызвать инструмент; поддержка зависит от платформы. Thinking blocks имеют правила сохранения, связанные с моделью, аккаунтом и историей. Для сравнения начинайте новую беседу. Прогресс между инструментами может приходить в thinking blocks, скрытых по умолчанию: проверяйте типы блоков и streaming, прежде чем считать отсутствие текста зависанием. Замена ID не подтверждает совместимость любого шлюза.

Как проверить на собственных задачах

Можно заранее выбрать по шесть задач в четырёх группах: ограниченное программирование, сложная отладка/рефакторинг, инструменты, документы/изображения. 24 задачи × 2 модели × 3 повтора дают 144 запуска задач; API-запросов может быть больше. Это предлагаемый протокол, не проведённый нами эксперимент.

Зафиксируйте commit, prompt, инструменты, регион, права, лимиты времени/шагов и тесты. Сбрасывайте среду и беседу, чередуйте порядок моделей. Сравнение на явном medium отделяйте от стандартных и повышенных настроек. Записывайте ошибки, отказы, повторы, наблюдаемые fallback, токены, деньги, время и реальные исправления. Код проверяйте скрытыми тестами, документы — источниками. Три повтора не дают точного P95 по задаче. При отсутствии успехов нельзя записывать нулевую стоимость успеха.

Частые вопросы

Sonnet 5.5 лучше пишет код?

Он выше в опубликованном Terminal-Bench, а Opus выше в остальных приведённых coding-тестах. Настройки и неопределённость не позволяют сделать общий вывод.

Задача всегда стоит вдвое дешевле?

Вдвое ниже обычные цены ввода и вывода, но не чтения кэша. Использование, повторы, инструменты и исправления меняют итог.

Что выбрать в Claude Code?

Sonnet можно оценить для ясных задач, Opus — для сложного исследования или как исходный вариант при приоритете качества. Подписка и API оплачиваются отдельно; см. стоимость Claude Code.

У Opus больше контекст?

В этой паре обе модели заявляют 1M контекста и обычный максимум вывода 128K. Важнее проверить использование информации.

Актуальные предложения и источники

Страницы Sonnet 5.5, Opus 5.5 и каталог показывают маршруты и цены OmniaKey. Расчёт прямого API не является тарифным предложением шлюза или проверкой реального вызова. Официальные материалы Anthropic по ссылкам доступны на английском.