Opus 5.5 или Sonnet 5.5
Выбирайте по результату и полной стоимости задачи.
Выбирать между Claude Opus 5.5 и Sonnet 5.5 стоит по принятому результату и полной стоимости задачи. Sonnet удобно взять за основу проверки ограниченных изменений, воспроизводимых ошибок и задач с тестами. Opus стоит оценить, если причина сбоя остаётся неясной, изменение затрагивает несколько систем или правдоподобная ошибка обернётся дорогой переделкой. Это стратегия оценки, а не универсальный рейтинг.
Стандартные входные и выходные токены Sonnet вдвое дешевле, но чтение кэша у моделей стоит одинаково. В опубликованных тестах программирования тоже нет победителя во всех дисциплинах.
Официальные источники проверены 29 сентября 2026 года. Собственное сравнительное тестирование не проводилось. Баллы приведены с указанием источников, а цены задач рассчитаны при фиксированном числе токенов: это не измеренные счета. OmniaKey публикует материал и предоставляет API-шлюз с отдельными тарифами.
Чем отличаются Opus 5.5 и Sonnet 5.5
Opus 5.5 вышел 22 сентября 2026 года, Sonnet 5.5 — 28 сентября. Сравнение с Sonnet 5 сохранено для предыдущей версии.
| Параметр | Sonnet 5.5 | Opus 5.5 |
|---|---|---|
| ID в Claude API | claude-sonnet-5-5 | claude-opus-5-5 |
| Контекст / обычный максимум вывода | 1M / 128K токенов | 1M / 128K токенов |
| Вход → выход | Текст и изображения → текст | Текст и изображения → текст |
| Effort API по умолчанию | high | medium |
| Рассуждение | Adaptive; доступен between_tools | Adaptive, всегда включено |
| Категория задержки производителя | Fast | Moderate |
| Ввод / вывод за миллион токенов | $2 / $10 | $4 / $20 |
| Чтение кэша за миллион токенов | $0.20 | $0.20 |
Источник: официальный обзор моделей. Одинаковый контекст не означает одинаковую точность поиска сведений. Ввод и вывод должны укладываться в общий допустимый бюджет. Вывод 300K — отдельная бета-возможность Batch API, а не обычный синхронный лимит.
Программирование: что показывают тесты
Цифры взяты из сравнительной таблицы анонса Sonnet 5.5. OmniaKey не повторяла эти измерения.
| Оценка | Sonnet 5.5 | Opus 5.5 |
|---|---|---|
| Terminal-Bench 4.0 | 70.6% (max) | 66.4% (xhigh) |
| FrontierCode 1.1 Main | 46.2% (max); 52.1% (xhigh) | 54.4% |
| CursorBench 4.0 | 55.5% | 57.8% |
| GDPval-AA v2.1 | 1844 | 1846 |
В system card, §8.5, указаны 66 задач Terminal-Bench и пять попыток каждой: по 330 попыток на модель. При допущении независимости попыток стандартная ошибка составляет ±2,5 пункта для Sonnet и ±2,6 для Opus. Использовался Claude Code в режиме --bare, с защитными механизмами и резервными моделями для части запросов; доли затронутых попыток различаются. Разница 4,2 пункта не доказывает превосходство во всём программировании или статистическую значимость без дополнительных данных.
У Sonnet в FrontierCode результат max ниже, чем xhigh. В примечании к анонсу объясняется: более частый запуск процесса ревью в разобранных случаях приводил к таймауту или изменениям вне задания. Больше рассуждений не обязательно улучшает итоговый патч.
GDPval измеряется баллами, не процентами. Для результатов Sonnet в GDPval-AA и AA-Briefcase раскрыт также исправленный впоследствии баг структурированного вывода в предварительном развёртывании. Подробности версий — в обзорах Sonnet 5.5 и Opus 5.5.
Цены API и кэш
Это стандартные глобальные цены прямого API из тарифной документации, USD за миллион токенов. Налоги, инструменты, региональные условия и сборы других платформ не включены. Фиксированная цена в рублях здесь не предполагается.
| Категория | Sonnet 5.5 | Opus 5.5 |
|---|---|---|
| Некэшированный ввод | $2 | $4 |
| Оплачиваемый вывод | $10 | $20 |
| Запись кэша на 5 минут | $2.50 | $5 |
| Запись кэша на 1 час | $4 | $8 |
| Чтение кэша | $0.20 | $0.20 |
Оплачиваемый вывод включает рассуждение. Минимальный кэшируемый prompt обеих моделей — 512 токенов, но попадание в кэш подтверждается полями usage. Ниже одинаковые объёмы, а не реальные измерения. Они могут суммироваться по нескольким запросам, каждый из которых соблюдает свои лимиты.
| Одинаковая нагрузка | Sonnet 5.5 | Opus 5.5 |
|---|---|---|
| 100K некэшированного ввода + 20K вывода | $0.40 | $0.80 |
| То же + первая запись 800K в кэш на 5 минут | $2.40 | $4.80 |
| 100K некэшированного ввода + 800K действительного чтения кэша + 20K вывода | $0.56 | $0.96 |
Последняя строка: Sonnet 0.1 × 2 + 0.8 × 0.20 + 0.02 × 10 = $0.56, Opus 0.1 × 4 + 0.8 × 0.20 + 0.02 × 20 = $0.96. На этапе чтения разница примерно в 1,71 раза; предварительная запись оплачивается отдельно. Не учитывайте записанные токены повторно как некэшированный ввод.
Реальные задачи расходуют разные объёмы и требуют разных повторов. Делите все расходы, включая неудачные попытки, на число принятых результатов. Время ручного исправления измеряйте отдельно, прежде чем переводить его в деньги по явно указанной ставке.
Скорость и настройки рассуждения
Заявления Sonnet 5.5 об ускорении вывода на 30%+ и снижении цены задачи до 30% относятся к сравнению с Sonnet 5. Это не разница с Opus 5.5 и не снижение тарифов API на 30%. Типичная экономия около 40%, заявленная для Opus 5.5, относится к Opus 5.
Sonnet по умолчанию использует high в API, но medium в Claude Code и приложениях. API Opus использует medium. Указывайте клиент и настройку: одинаковое название effort не означает одинаковый вычислительный бюджет. Время до первого полезного ответа и до проверенного завершения задачи — разные показатели.
Когда стоит переплачивать за Opus
Проверяйте Sonnet на ограниченных функциях, точечных ревью и структурированном извлечении данных. Для Opus полезны неоднозначные межсервисные ошибки, сложные миграции и долгие исследования. Одинаковые исходные данные и приёмка покажут, уменьшается ли переделка. Цена не гарантирует правильность или безопасность.
В длинных документах проверяйте ссылки и пропуски условий, в визуальных задачах — нужные скриншоты и графики. Понимание изображений не равно их нативной генерации. Наша рекомендация учитывает расходы; общий гайд Anthropic предлагает начинать большинство задач с Opus 5.5. Это разумно при приоритете качества. Более широкий выбор описан в гайде моделей для Claude Code.
Перед сменой модели
Прочитайте руководства по миграции Sonnet и Opus. between_tools у Sonnet при high или ниже убирает предварительное рассуждение, но не все его формы. Opus сохраняет adaptive thinking.
Обе модели отклоняют принудительный tool_choice типов any и tool. Строгая валидация аргументов не заставляет вызвать инструмент; поддержка зависит от платформы. Thinking blocks имеют правила сохранения, связанные с моделью, аккаунтом и историей. Для сравнения начинайте новую беседу. Прогресс между инструментами может приходить в thinking blocks, скрытых по умолчанию: проверяйте типы блоков и streaming, прежде чем считать отсутствие текста зависанием. Замена ID не подтверждает совместимость любого шлюза.
Как проверить на собственных задачах
Можно заранее выбрать по шесть задач в четырёх группах: ограниченное программирование, сложная отладка/рефакторинг, инструменты, документы/изображения. 24 задачи × 2 модели × 3 повтора дают 144 запуска задач; API-запросов может быть больше. Это предлагаемый протокол, не проведённый нами эксперимент.
Зафиксируйте commit, prompt, инструменты, регион, права, лимиты времени/шагов и тесты. Сбрасывайте среду и беседу, чередуйте порядок моделей. Сравнение на явном medium отделяйте от стандартных и повышенных настроек. Записывайте ошибки, отказы, повторы, наблюдаемые fallback, токены, деньги, время и реальные исправления. Код проверяйте скрытыми тестами, документы — источниками. Три повтора не дают точного P95 по задаче. При отсутствии успехов нельзя записывать нулевую стоимость успеха.
Частые вопросы
Sonnet 5.5 лучше пишет код?
Он выше в опубликованном Terminal-Bench, а Opus выше в остальных приведённых coding-тестах. Настройки и неопределённость не позволяют сделать общий вывод.
Задача всегда стоит вдвое дешевле?
Вдвое ниже обычные цены ввода и вывода, но не чтения кэша. Использование, повторы, инструменты и исправления меняют итог.
Что выбрать в Claude Code?
Sonnet можно оценить для ясных задач, Opus — для сложного исследования или как исходный вариант при приоритете качества. Подписка и API оплачиваются отдельно; см. стоимость Claude Code.
У Opus больше контекст?
В этой паре обе модели заявляют 1M контекста и обычный максимум вывода 128K. Важнее проверить использование информации.
Актуальные предложения и источники
Страницы Sonnet 5.5, Opus 5.5 и каталог показывают маршруты и цены OmniaKey. Расчёт прямого API не является тарифным предложением шлюза или проверкой реального вызова. Официальные материалы Anthropic по ссылкам доступны на английском.