GPT-6 Sol·Claude Opus 5.5 출시GPT-6 Sol 요금은 5.6 Sol의 절반
블로그
가이드

Claude Sonnet 5.5 리뷰

일상 작업을 더 빠르게 만드는 모델이지만, 버전 번호보다 API 계약의 변화가 더 중요합니다.

약 12분OmniaKey
Claude Sonnet 5.5모델 리뷰API 가격Claude Code마이그레이션

Claude Sonnet 5.5는 Anthropic Claude 5.5 제품군에서 일상 작업을 맡는 실용적인 업그레이드입니다. 2026년 9월 28일 출시되었고 표준 API 토큰 가격은 Sonnet 5와 같지만, Anthropic은 출력 생성이 30% 이상 빠르고 작업당 비용이 최대 30% 낮아졌다고 설명합니다. 공개 코딩 및 지식 작업 점수도 Opus 5.5에 가까워졌습니다.

그렇다고 Sonnet 5.5가 Opus를 모든 작업에서 대체하는 것은 아닙니다. 범위가 분명한 기능 구현, 재현 가능한 버그 수정, 문서와 스프레드시트 작성, 빠른 에이전트 반복에 특히 어울립니다. 개발자가 조심해야 할 부분은 API 계약입니다. 기존 Sonnet 5 클라이언트가 thinking 비활성화, 강제 도구 호출, 이전 computer use 도구 또는 content[0]만 읽는 응답 처리에 의존한다면 모델 ID만 바꾸면 안 됩니다.

2026년 9월 29일 확인. Anthropic 발표와 Claude Platform 최신 문서를 기준으로 작성했습니다. 아래 벤치마크·속도·비용 주장은 Anthropic이 공개한 값이며, 독립적인 유료 벤치마크나 지연 시간 측정은 수행하지 않았습니다. 비용 예시는 직접 API 표준 요금에서 토큰 수를 고정해 계산했습니다.

Claude Sonnet 5.5 사양 요약

항목Claude Sonnet 5.5
출시일2026년 9월 28일
Claude API 모델 IDclaude-sonnet-5-5
컨텍스트 윈도1M 토큰
일반 최대 출력128K 토큰
입력 / 출력백만 토큰당 $2 / $10
캐시 쓰기 / 읽기백만 토큰당 $2.50 / $0.20
Thinking기본 Adaptive
기본 efforthigh
상대 지연 시간Fast
지식 기준일2026년 6월
입력과 출력텍스트·이미지 → 텍스트

Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry, Claude Platform on AWS에서 사용할 수 있습니다. 플랫폼별 모델 ID 표기가 다를 수 있으므로 운영 환경의 제공 목록을 확인해야 합니다. 동기 Messages 요청의 한도는 1M 컨텍스트와 128K 출력이고, Batch API는 별도 베타 헤더에서 300K 출력을 지원합니다.

Sonnet 5보다 무엇이 좋아졌나

Anthropic의 핵심 주장은 생성 속도 30% 이상 향상과 작업당 최대 30% 비용 절감입니다. 토큰 가격을 내린 것이 아니라, 더 적은 출력 토큰과 도구 단계로 같은 작업을 끝내는 방식입니다.

발표 자료는 Sonnet 5와 비교한 다음 결과를 제시합니다.

평가Sonnet 5.5Sonnet 5측정 대상
Terminal-Bench 4.070.6%10.3%다단계 터미널 코딩
CursorBench 4.055.5%34.1%모호한 코딩 에이전트 작업
GDPval-AA v2.118441449여러 직업의 지식 작업
AA-Briefcase v1.118111359장기 지식 작업
Humanity’s Last Exam64.5%54.9%도구를 사용한 다학제 추론
OSWorld 2.180.1% partial57.0% partialComputer use
Chartography61.6%15.6%차트 시각 인식

이 수치는 여러분의 저장소 성공률이 아니라 테스트 조건에서의 신호입니다. CursorBench는 Opus 5.5의 57.8%에 가깝고 GDPval도 Opus 5.5의 1846에 근접하지만, Anthropic은 복잡하고 열린 판단이 필요한 작업에서는 Opus가 여전히 강하다고 설명합니다. 반복 가능한 작업의 격차가 줄었다고 이해하는 편이 안전합니다.

Anthropic의 비용 차트는 effort와 도구 호출까지 포함한 작업 비용을 비교합니다. 프롬프트, 권한, 저장소, 검증 테스트를 고정한 뒤 Opus 5.5 모델 페이지와 실제 Sonnet 경로를 비교하세요.

API 가격

Sonnet 5.5의 직접 Anthropic API 가격은 Sonnet 5와 같습니다.

과금 항목가격
캐시되지 않은 입력$2 / MTok
출력(과금되는 thinking 토큰 포함)$10 / MTok
5분 캐시 쓰기$2.50 / MTok
1시간 캐시 쓰기$4 / MTok
캐시 읽기$0.20 / MTok
Batch API입력·출력 50% 할인

캐시가 없는 100K 입력과 20K 출력을 사용하면 0.1 × $2 + 0.02 × $10 = $0.40입니다. 80K 입력이 캐시 적중이면 같은 토큰 수에서 0.02 × $2 + 0.08 × $0.20 + 0.02 × $10 = $0.376이고 최초 캐시 쓰기는 별도입니다. thinking 토큰, 도구, 재시도와 턴 수에 따라 실제 청구액은 달라집니다.

따라서 “작업당 최대 30% 저렴”은 모든 청구서가 30% 할인된다는 뜻이 아닙니다. 테스트나 리뷰를 통과한 변경 한 건당 입력·캐시·출력·도구 비용을 측정하세요. OmniaKey 게이트웨이 가격은 별도이므로 도입 전 최신 모델 카탈로그를 확인해야 합니다.

마이그레이션에서 깨질 수 있는 부분

모델 ID는 claude-sonnet-5-5로 바꾸면 되지만 요청 설정은 그대로 호환되지 않을 수 있습니다.

  1. Thinking은 기본 Adaptive입니다. thinking을 생략하거나 {"type":"adaptive"}를 사용합니다. 앞단 thinking을 끄려면 thinking: {"type":"between_tools"}를 보내세요. 예전 disabled와 수동 budget_tokens는 400을 반환합니다.
  2. 강제 도구 호출은 지원하지 않습니다. tool_choice의 any와 tool은 400입니다. auto 또는 none을 사용하고, 스키마 검증은 strict 도구나 structured outputs로 처리하세요.
  3. Thinking block을 모델 간에 마음대로 넘길 수 없습니다. Sonnet 5.5는 Sonnet 5 block을 읽지만 Opus 5와 Opus 5.5는 Sonnet 5.5 block을 읽지 못합니다. 대화 중 모델을 바꾸면 다음 요청의 문맥이 달라집니다.
  4. 이력을 수정한 뒤 block을 재전송하지 마세요. 이전 system, tool 또는 메시지를 바꾸고 thinking block을 다시 보내면 계정에 따라 400이 됩니다. 새 지시는 추가 메시지로 보내거나 공식 binding 제어를 사용하세요.
  5. 플랫폼별 computer use를 확인하세요. Claude API와 Google Cloud는 computer_toolset_20260801, Bedrock은 이전 computer_20251124를 사용합니다.
  6. 스트리밍 응답을 block type별로 읽으세요. 도구 사이 진행 메시지가 thinking progress-update block으로 올 수 있습니다. text만 렌더링하면 요청이 멈춘 것처럼 보입니다.

최소 요청 예시는 다음과 같습니다.

json
{
  "model": "claude-sonnet-5-5",
  "max_tokens": 4096,
  "output_config": {"effort": "high"},
  "messages": [
    {"role": "user", "content": "이 마이그레이션의 가장 큰 위험 세 가지를 검토해 주세요."}
  ]
}

비기본 temperature, top_p, top_k도 새 모델 문서를 확인하기 전에는 그대로 복사하지 마세요. max_tokens에는 thinking과 표시할 답변을 모두 담을 여유가 필요합니다.

실제 워크플로에서의 위치

범위가 정해진 기능, 재현 버그, 기존 인터페이스 테스트, 좁은 코드 리뷰, 문서 초안, 고빈도 에이전트 단계부터 시작하는 것이 좋습니다. 테스트·타입 검사·빌드·스크린샷처럼 결정적인 검증이 있으면 저렴한 모델이 충분한지 빠르게 확인할 수 있습니다.

여러 서비스에 걸친 설계, 되돌리기 어려운 마이그레이션, 정보가 부족한 조사라면 effort를 높이거나 더 강한 모델로 올리세요. 올바른 파일과 도구를 주고도 원인을 계속 놓치면 능력의 신호입니다. 요구사항이나 환경이 불완전해서 검증하지 못한 것이라면 먼저 문맥을 고치는 편이 낫습니다.

Claude Code에서는 새 세션에서 같은 저장소, 권한, 프롬프트와 인수 테스트를 비교하세요. 유용한 첫 결과까지의 시간, 전체 시간, 토큰, 재시도, 실패한 도구 호출과 사람의 수정 시간을 기록하면 속도 주장을 실제 비용과 연결할 수 있습니다.

결론

Claude Sonnet 5.5는 일상 코딩과 지식 작업의 첫 테스트 기본값으로 삼을 만합니다. 토큰 가격을 유지하면서 속도와 공개 성능을 높였고, 범위가 분명한 작업을 옮길 이유가 충분합니다.

하지만 모델 문자열만 바꿔서 배포하지 마세요. thinking, tool choice, 응답 block 파서와 computer use를 먼저 검증하고, 모호한 설계와 중요한 판단은 Opus 5.5에 남겨 두는 편이 좋습니다. 두 모델을 비교할 때는 Opus 5.5와 Sonnet 5 비교도 참고하세요.

자주 묻는 질문

Claude Sonnet 5.5는 언제 출시되었나요?

2026년 9월 28일입니다. 직접 Claude API ID는 claude-sonnet-5-5입니다.

Sonnet 5.5가 Sonnet 5보다 저렴한가요?

토큰 가격은 같습니다. 입력 $2, 출력 $10, 캐시 읽기 $0.20/MTok이며, Anthropic은 더 적은 토큰과 도구 단계로 작업당 최대 30% 저렴하다고 보고합니다.

Sonnet 5.5가 Opus 5.5보다 좋은가요?

작업에 따라 다릅니다. 명확한 일상 작업에는 더 빠르고 저렴한 Sonnet이, 복잡하고 열린 판단에는 Opus가 적합합니다. 실제 승인 결과와 총비용, 수정 시간을 비교하세요.

Thinking을 끌 수 있나요?

기존 thinking: {"type":"disabled"}는 사용할 수 없습니다. Adaptive를 사용하거나 지원되는 effort에서 between_tools를 사용하세요.

컨텍스트가 1M인가요?

1M 토큰 컨텍스트와 128K 일반 최대 출력을 제공합니다. 이는 용량 한도이지 무료 사용량이나 무제한 크레딧이 아닙니다.

확인한 출처