Jev 모델 정식 출시 · Grok 4.7 지원 추가
블로그
가이드

Claude Opus 5.5 총정리

가격은 낮아졌지만 기존 API를 옮길 때는 사고와 도구 호출 설정을 확인해야 합니다.

약 11분OmniaKey
Claude Opus 5.5API 가격Opus 5 비교Claude Code사용법

Claude Opus 5.5는 긴 코딩 작업과 지식 업무에 우선 시험해 볼 만한 모델입니다. Anthropic은 2026년 9월 22일 이 모델을 정식 출시했습니다. 표준 API 가격은 입력 100만 토큰당 4달러, 출력 20달러로 내려갔고, 공개한 코딩 평가에서는 Opus 5보다 높은 결과를 제시합니다.

다만 모델 이름만 바꾸면 끝나는 업그레이드는 아닙니다. 이전에 허용된 요청이 400 오류를 내거나 도구 실행 사이의 진행 안내가 사라질 수 있습니다. 새로운 기본값인 medium에서 시작해 완료율, 청구 토큰, 사람이 수정하는 시간을 함께 비교하세요.

2026년 9월 23일 확인. 공식 발표와 모델·마이그레이션 문서를 분석한 글입니다. 독립 벤치마크나 유료 속도 측정은 진행하지 않았습니다. 아래 성능 수치는 출처를 밝히며 비용은 Anthropic 직접 API 정가로 계산합니다.

Opus 5.5에서 달라진 점

Claude 5.5 제품군의 첫 모델로, 대규모 코드 이전, 어려운 디버깅, 문서 분석처럼 여러 단계를 거치는 업무에 초점을 맞췄습니다. Anthropic은 더 자연스러운 글쓰기, 향상된 차트 이해, 복잡한 작업에서의 단계 감소를 강조합니다. 초기 사용 사례는 시험할 작업을 고르는 데 유용하지만 내 프로젝트의 처리 시간을 보장하지는 않습니다.

항목사양
출시일2026년 9월 22일
API IDclaude-opus-5-5
컨텍스트 / 표준 최대 출력1M / 128K tokens
입력 → 출력텍스트·이미지 → 텍스트
지식 기준 시점2026년 6월
사고 / 기본 effort항상 adaptive / medium
최소 캐시 길이512 tokens

1M 컨텍스트와 128K 표준 출력 상한은 Opus 5와 같습니다. Batch API의 300K 출력은 별도 베타 기능이며 동기 요청의 한도가 아닙니다. 이미지를 이해하거나 그래픽을 만드는 코드를 작성할 수 있지만, 이미지·영상을 직접 생성하는 모델로 보아서는 안 됩니다.

Opus 5 비교: 가격보다 먼저 확인할 설정

일반 입력·출력 단가는 20%, 캐시 읽기는 60% 낮아졌습니다. 같은 저장소 문맥을 반복해서 읽는 에이전트라면 캐시 활용에 따라 절약 폭이 달라집니다.

기본 effort는 high에서 medium으로 바뀝니다. 동일한 이름의 설정에서도 5.5가 한 턴에 더 많이 사고할 수 있으며 특히 xhigh, max에서 두드러집니다. 설정 이름을 유지한다고 연산량까지 유지되는 것은 아닙니다.

또한 사고를 끌 수 없고 강제 도구 선택도 지원하지 않습니다. 이전 대화를 수정하는 방식에도 제약이 있습니다. 배경은 Opus 5 리뷰, 반복 업무의 모델 배분은 Claude Code 모델 선택 가이드를 참고하세요.

벤치마크로 본 코딩 성능

아래는 Anthropic 출시 발표에 실린 표입니다. OmniaKey가 재실행한 결과나 별도로 확인한 최신 독립 순위가 아닙니다.

평가Opus 5.5Opus 5Fable 5.1
Terminal-Bench 4.066.4%52.3%55.8%
FrontierCode v1.1 Main54.4%48.0%50.3%
CursorBench 4.057.8%46.6%51.8%
GDPval-AA v2.1184617081735

별도 표기가 없으면 5.5는 max를 사용하며 Terminal-Bench는 xhigh입니다. 해당 점수의 표준오차는 ±2.6%포인트입니다. 운영용 안전장치를 켠 상태에서 일부 보안·생물학·첨단 모델 개발 작업은 다른 모델로 넘겼습니다. 모든 모델이 같은 무제한 조건에서 평가됐다고 해석하면 안 됩니다.

기본 medium에서도 공식 결과는 FrontierCode 54.6%, CursorBench **52.5%**입니다. FrontierCode의 medium 점수가 표의 max보다 조금 높다는 점은 effort를 올린다고 항상 점수가 상승하지는 않음을 보여줍니다. GDPval-AA v2.1 수치를 이전 v2 결과와 그대로 비교하는 것도 피하세요.

Claude Opus 5.5 API 가격과 비용 계산

다음은 글로벌 표준 직접 API의 100만 토큰당 미국 달러 가격입니다. 도구, 세금, 지역 지정 요금과 외부 게이트웨이 가격은 별도입니다.

청구 항목Opus 5.5Opus 5단가 인하율
캐시되지 않은 입력$4$520%
출력 및 과금 사고 토큰$20$2520%
캐시 읽기$0.20$0.5060%
5분 캐시 쓰기$5$6.2520%
1시간 캐시 쓰기$8$1020%

다음 출력량에는 과금되는 사고 토큰도 포함합니다.

동일한 토큰 사용량5.5 계산Opus 5.5Opus 5
100K 일반 입력 + 10K 출력0.1 × $4 + 0.01 × $20$0.60$0.75
100K 일반 입력 + 900K 캐시 적중 + 10K 출력0.1 × $4 + 0.9 × $0.20 + 0.01 × $20$0.78$1.20

캐시 예시는 35% 저렴하지만 이전 캐시 쓰기 비용은 제외했습니다. 실제 적중 여부는 공급자의 usage로 확인해야 합니다. 같은 텍스트를 다시 보내는 것만으로 캐시 적중이 입증되지는 않습니다.

공식 발표의 일반적인 작업 비용 40% 감소는 기본 설정에서 단가와 사용량을 함께 측정한 결과입니다. 모든 요청에 일괄 40% 할인이 적용된다는 뜻은 아닙니다. 출력 속도 30% 이상 향상 역시 전체 작업 시간의 보장이 아닙니다.

Fast mode는 연구 프리뷰로 입력/출력 $8/$40, 공식 설명상 최대 2.5배 속도이며 API 옵션은 Anthropic 자체 플랫폼에 한정됩니다. 비동기 Batch는 $2/$10입니다. Claude 구독 한도와 API 사용량 청구도 별도이므로 Claude Code 가격 가이드에서 결제 경로를 확인하세요.

API 사용법: 이전 전에 점검할 6가지

  1. 사고 설정을 정리하세요. thinking.type: "disabled"budget_tokens를 지정한 "enabled"는 400 오류입니다. thinking을 생략하거나 adaptive를 쓰고 output_config.effort로 조절합니다.
  2. 강제 도구 선택을 바꾸세요. tool_choiceany, tool은 지원하지 않습니다. auto 또는 none을 사용합니다. strict: true는 도구 인자를 검증할 뿐 호출을 강제하지 않습니다. JSON 형식이 목적이면 구조화 출력을 검토하세요.
  3. 이전 대화를 보존하세요. 2026년 8월 31일 00:00 UTC 이후 생성한 계정에서는 사고 블록 앞의 system, tools, 메시지를 수정해 재전송하면 400이 발생할 수 있습니다. 기록은 가급적 추가만 하고 수정할 때는 preserved thinking 문서를 따릅니다.
  4. 블록의 type을 읽으세요. 도구 사이 진행 안내는 thinking 블록에 들어갑니다. 기본 display: "omitted"에서는 문자열이 비어 있습니다. 표시가 필요하면 문서의 "summarized" 또는 베타 "updates"를 확인하고 도구 루프의 사고 블록은 그대로 돌려보내세요.
  5. computer use는 플랫폼별로 확인하세요. Claude API와 Google Cloud는 computer_toolset_20260801이 필요합니다. 예전 computer_20251124는 Amazon Bedrock에서는 계속 동작합니다.
  6. 거절과 모델 변경을 처리하세요. HTTP 200에 stop_reason: "refusal"이 오면 작업 성공이 아닙니다. Opus 5로 되돌리면 5.5의 사고를 이어받지 못합니다. Claude API의 Fable 5.1과 Mythos 5.1은 이를 읽을 수 있는 예외입니다.

아래는 Anthropic 직접 API 예시로 Anthropic 키를 사용합니다. OmniaKey 키를 넣는 설정이 아니며 유료 요청은 실행하지 않았습니다.

bash
curl https://api.anthropic.com/v1/messages \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-opus-5-5",
    "max_tokens": 4096,
    "output_config": {"effort": "medium"},
    "messages": [{"role": "user", "content": "이 마이그레이션 계획을 검토하고 주요 위험 세 가지를 알려주세요."}]
  }'

max_tokens에는 사고와 표시될 답변의 공간이 모두 필요합니다. content[0]을 답변으로 가정하지 말고 text 블록을 모아 읽으세요.

누구에게 권장하며 어디서 사용할 수 있나요?

Opus 5 사용자는 큰 리팩터링, 복잡한 버그, 실패 비용이 큰 작업부터 비교하세요. 도구·권한·합격 기준을 고정하고 medium, high에서 성공, 재시도, 토큰, 시간, 사람의 수정을 기록합니다. 모델을 비교할 때는 새 대화가 조건을 맞추기 쉽습니다.

단순 편집이나 추출은 Sonnet이 더 경제적일 수 있습니다. Fable 사용자는 5.5가 같은 품질 기준을 낮은 비용으로 만족하는지 시험하면 됩니다. 공식 제공 경로는 Claude, Claude Code, Claude API, Amazon Bedrock, Claude Platform on AWS, Google Cloud, Microsoft Foundry입니다. 계정과 지역별 조건은 각 플랫폼을 따릅니다.

이 글은 OmniaKey의 5.5 실시간 경로를 확인한 자료가 아닙니다. 연결 전에 현재 모델 목록에서 정확한 ID와 가격을 확인하세요.

자주 묻는 질문

Opus 5.5 출시일은 언제인가요?

2026년 9월 22일입니다. 공식 API ID는 claude-opus-5-5이며 미확인 출시설이 아닙니다.

Opus 5보다 코딩을 잘하나요?

공식 공개 평가에서는 더 높은 점수를 보이고 토큰 단가도 낮습니다. 다만 실제 도구 루프와 작업 합격 기준을 통과하는지는 별도로 검증해야 합니다.

사고 기능을 끌 수 있나요?

아니요. Adaptive thinking은 항상 켜집니다. 비용이나 대기 시간을 줄이려면 effort를 낮추고 품질을 확인하세요.

1M 컨텍스트는 무제한 사용을 뜻하나요?

아닙니다. 처리 용량의 상한이며 무료 토큰이 아닙니다. 입력·출력·캐시·도구 요금과 계정 제한은 그대로 적용됩니다.

참고 자료