💡 핵심 요약 — Claude Opus 5.5 가격 (BLUF)
- 질문: 생각 모드를 끌 수 없게 된 Claude Opus 5.5가 실제로 Opus 5보다 저렴합니까?
- 측정: Anthropic 공식 가격표로 계산하면, 같은 토큰 수 기준 Opus 5.5가 세 가지 작업 형태에서 20%~35.5% 저렴합니다. 입력 중 캐시로 처리되는 비중이 클수록 절감폭이 커집니다.
- 함정: 생각 토큰은 출력으로 과금됩니다. 캐시 없는 요청에서 Opus 5.5의 출력이 +41.7%(캐시를 쓰는 세션은 +32.3%)를 넘으면 Opus 5보다 비싸집니다.
- 규칙: 캐시 비중이 큰 에이전트 작업부터 옮기고, Opus 5에서 생각 모드를 끄고 돌리던 작업은 옮기기 전에
thinking_tokens부터 측정하십시오.
Anthropic은 2026년 9월 22일 Claude Opus 5.5를 100만 토큰당 입력 $4, 출력 $20에 출시했습니다. Opus 5보다 20% 낮은 가격이며, 캐시 읽기는 60% 낮춘 $0.20입니다. 발표문에는 다음 문장도 있습니다. Opus 5.5는 “생각 모드를 끈 상태로는 더 이상 제공되지 않습니다.”
Anthropic 생각 모드 문서는 추론 토큰을 과금되는 출력 토큰 안에 포함하고, 출력 단가로 청구합니다. 따라서 토큰당 단가가 낮은 모델도 추론을 더 많이 생성하면 작업당 비용이 더 커질 수 있습니다. 이 글은 공식 가격표로 세 가지 작업 형태의 모델별 비용과, Opus 5.5가 더 이상 저렴하지 않게 되는 출력 증가폭을 계산합니다.
가격표에서 정확히 무엇이 바뀌었습니까?
| 항목 (100만 토큰당) | Claude Opus 5 | Claude Opus 5.5 | 변화 |
|---|---|---|---|
| 기본 입력 | $5 | $4 | −20% |
| 출력 | $25 | $20 | −20% |
| 캐시 읽기(히트) | $0.50 | $0.20 | −60% |
| 5분 캐시 쓰기 | $6.25 | $5 | −20% |
| 1시간 캐시 쓰기 | $10 | $8 | −20% |
| 배치 입력 / 출력 | $2.50 / $12.50 | $2 / $10 | −20% |
| fast mode 입력 / 출력 | $10 / $50 | $8 / $40 | −20% |
| 생각 모드 | 기본 활성, effort high 이하에서 끌 수 있음 | 상시 활성, 끌 수 없음 | — |
캐시 읽기 인하폭은 입력 인하폭의 세 배입니다. Anthropic은 Opus 5.5의 캐시 히트를 표준 0.1배가 아니라 기본 입력가의 0.05배로 책정했습니다. 생각 모드도 바뀌었습니다. 7월 24일 Opus 5 릴리스 노트는 effort high 이하에서 생각 모드를 끌 수 있게 했지만, 9월 22일 Opus 5.5 릴리스 노트는 끌 수 없는 “상시 적응형 생각(always-on adaptive thinking)“이라고 설명합니다.
두 모델 모두 Claude 4.7부터 도입된 새 토크나이저를 쓰므로, 같은 텍스트는 어느 모델에서나 같은 토큰 수가 나옵니다. 아래 비교에는 토크나이저 보정이 필요 없습니다.
같은 작업을 각 모델에서 돌리면 비용이 얼마입니까?
두 모델에 같은 토큰 수를 넣고 세 가지 작업 형태의 비용을 계산했습니다. 앞의 두 형태는 Anthropic 가격 페이지의 계산 예시에 나오는 토큰 구성(세션당 입력 50,000토큰, 출력 15,000토큰, 두 번째는 입력 중 40,000토큰이 캐시)을 그대로 썼습니다. 세 번째는 매 턴마다 컨텍스트 대부분을 캐시에서 다시 읽는 장시간 에이전트 루프입니다.
| 작업 형태 | Opus 5 | Opus 5.5 | 절감 | Sonnet 5 (참고) |
|---|---|---|---|---|
| 일반 요청: 캐시 없는 입력 50k, 출력 15k | $0.625 | $0.500 | −20.0% | $0.250 |
| 캐시를 쓰는 코딩 세션: 캐시 없는 입력 10k + 캐시 읽기 40k, 출력 15k | $0.445 | $0.348 | −21.8% | $0.178 |
| 장시간 에이전트 루프: 캐시 없는 입력 50k + 캐시 읽기 950k, 출력 20k | $1.225 | $0.790 | −35.5% | $0.490 |
본인 토큰 수로 다시 돌려 볼 수 있도록 계산식을 붙입니다.
PRICE = { # 100만 토큰당 $: 캐시 없는 입력, 캐시 읽기, 출력
"opus-5": (5.00, 0.50, 25.00),
"opus-5.5": (4.00, 0.20, 20.00),
"sonnet-5": (2.00, 0.20, 10.00),
}
def cost(model, uncached, cached, output):
i, c, o = PRICE[model]
return (uncached * i + cached * c + output * o) / 1_000_000
for shape in [(50_000, 0, 15_000), (10_000, 40_000, 15_000), (50_000, 950_000, 20_000)]:
print(shape, [round(cost(m, *shape), 3) for m in PRICE])
# (50000, 0, 15000) [0.625, 0.5, 0.25]
# (10000, 40000, 15000) [0.445, 0.348, 0.178]
# (50000, 950000, 20000) [1.225, 0.79, 0.49]
Opus 5.5의 할인폭이 가장 큰 항목이 캐시 읽기이므로, 입력 중 캐시로 처리되는 비중이 클수록 절감폭이 커집니다. Anthropic 발표문은 Opus 5.5가 “일반적인 작업에서 Opus 5보다 40% 저렴하다"고 주장합니다. 정가 계산만으로는 이 세 형태에서 20%~35.5%가 나옵니다. 40%까지의 차이는 Opus 5.5가 같은 작업을 더 적은 토큰으로 끝낼 때만 생기며, 이 글은 그 부분을 측정하지 않았습니다.
상시 생각 모드는 언제 절감분을 지웁니까?
생각 토큰이 출력으로 과금되므로, 질문은 이렇게 바뀝니다. 같은 작업에서 Opus 5.5가 출력을 얼마나 더 만들어야 Opus 5보다 비싸집니까? 입력을 고정하고 출력 배수를 풀면 작업 형태별 손익분기점이 하나씩 나옵니다.
| 작업 형태 | Opus 5 비용 | Opus 5.5 고정 입력 비용 | 손익분기 출력 (Opus 5 대비) |
|---|---|---|---|
| 일반 요청 | $0.625 | $0.200 | 1.42배 (+41.7%) |
| 캐시를 쓰는 코딩 세션 | $0.445 | $0.048 | 1.32배 (+32.3%) |
| 장시간 에이전트 루프 | $1.225 | $0.390 | 2.09배 (+109%) |
예를 들어 Opus 5에서 생각 모드를 끄고 돌려 출력 15,000토큰이 나오던 작업이라면, 일반 요청 기준으로 Opus 5.5는 추론에 약 6,250토큰(15,000 × 0.417)까지 더 써도 Opus 5보다 비싸지지 않습니다. 캐시를 쓰는 세션에서는 여유가 약 4,850토큰(15,000 × 0.323)으로 더 좁습니다. 입력 쪽이 이미 거의 0에 가깝게 할인됐기 때문입니다. 캐시 비중이 큰 에이전트 루프에서는 출력이 대략 두 배가 되어야 절감분이 사라집니다.
이 글에서 측정하지 않은 효과가 두 가지 더 있습니다. 적응형 생각은 요청마다 생각할지를 스스로 정하고, Anthropic 문서에 따르면 낮은 effort 설정에서는 “쉬운 입력에서 생각을 완전히 건너뛸 수 있습니다.” 단순한 호출에서는 비용 증가가 작습니다. 또 Opus 4.5 이후 Claude 모델은 이전 턴의 생각 블록을 컨텍스트에 유지하고 이를 입력으로 과금하므로, 긴 멀티턴 세션에서는 앞선 턴의 추론이 이후 턴에서 입력으로 다시 과금됩니다.
어떤 작업부터 Opus 5.5로 옮겨야 합니까?
| 작업 | Opus 5.5로 이전? | 이유 |
|---|---|---|
| 캐시 비중이 큰 에이전트 루프 (코드베이스를 반복해 읽는 장시간 세션) | 예, 가장 먼저 | 정가 절감폭이 가장 크고(−35.5%) 생각 모드가 절감분을 지우기까지 여유도 가장 큽니다(+109%) |
| 이미 생각 모드를 켜고 돌리던 Opus 5 작업 | 예 | 동작은 같고 모든 토큰 종류의 단가가 20% 낮습니다 |
effort high 이하에서 생각 모드를 끄고 돌리던 Opus 5 작업 | 먼저 측정 | 강제 생각이 출력을 늘립니다. 추가 출력이 +32%~+42% 미만일 때만 절감이 유지됩니다 |
| fast mode를 쓰는 지연 민감 경로 | Claude API에 머문다면 예 | fast mode가 $10/$50에서 $8/$40으로 내려갑니다. 파트너 클라우드와 Batch에서는 쓸 수 없습니다 |
| 대량의 일상 코딩 | Sonnet 5를 먼저 검토 | $2/$10으로 입력과 출력이 Opus 5.5의 절반입니다 |
운영 경로를 전환하기 전 점검 목록입니다.
- 실제 요청 표본에서 두 모델의
usage.output_tokens_details.thinking_tokens를 기록하십시오. 이 필드에 출력 중 추론에 쓰인 토큰 수가 나옵니다. - 요청 단위가 아니라 작업 단위로 출력을 비교하십시오. Opus 5.5가 더 적은 턴으로 끝낸다면 턴당 출력이 많아도 이길 수 있습니다.
- 캐시를 쓰는 대화에서는 effort 수준을 고정하십시오. 대화 도중 생각 설정을 바꾸면 캐시 중단점이 무효화되어 캐시 읽기 60% 할인이 적용되지 않습니다.
- 확정 전에 가격 페이지를 다시 확인하십시오. Anthropic은 6월 이후 Claude 가격을 두 번 바꿨습니다. Sonnet 5의 도입가 $2/$10은 정가가 됐고, Opus 5.5는 Opus 5보다 낮게 나왔습니다.
자주 묻는 질문 (FAQ)
Q. Claude Opus 5.5의 가격은 얼마입니까?
Claude API 기준 100만 토큰당 입력 $4, 출력 $20입니다. 캐시 읽기는 $0.20, 5분 캐시 쓰기는 $5, 1시간 캐시 쓰기는 $8입니다. Batch API를 쓰면 입력과 출력이 절반인 $2와 $10이 됩니다.
Q. Opus 5.5가 Opus 5보다 저렴합니까?
정가 기준으로는 그렇습니다. 입력과 출력이 20%, 캐시 읽기가 60% 낮습니다. 같은 토큰 수로 계산한 세 가지 작업 형태에서 비용이 20%~35.5% 줄었고, 캐시 비중이 큰 에이전트 루프에서 절감폭이 가장 컸습니다.
Q. Claude Opus 5.5에서 생각 모드를 끌 수 있습니까?
끌 수 없습니다. 릴리스 노트는 끌 수 없는 상시 적응형 생각이라고 설명하고, 발표문은 생각 모드를 끈 상태로는 더 이상 제공하지 않는다고 밝힙니다. Opus 5는 effort high 이하에서 생각 모드를 끌 수 있었습니다.
Q. 생각 토큰은 출력으로 과금됩니까?
그렇습니다. Anthropic 생각 모드 문서는 추론 토큰을 과금되는 출력 토큰에 포함하고 usage.output_tokens_details.thinking_tokens로 따로 보고합니다. Opus 5.5에서는 이 추론이 100만 토큰당 $20의 출력 단가로 과금됩니다.
Q. Opus 5.5가 Opus 5보다 비싸지는 시점은 언제입니까?
같은 작업에서 출력이 손익분기점을 넘을 때입니다. 캐시 없는 일반 요청은 약 +41.7%, 캐시를 쓰는 코딩 세션은 +32.3%, 캐시 비중이 큰 장시간 에이전트 루프는 +109%입니다.
Q. Opus 5.5와 Sonnet 5의 가격은 어떻게 다릅니까?
Sonnet 5는 $2/$10, 캐시 읽기 $0.20으로 입력과 출력이 Opus 5.5의 절반입니다. 위 세 가지 작업 형태에서 Sonnet 5는 $0.25, $0.178, $0.49로 Opus 5.5의 $0.50, $0.348, $0.79보다 저렴합니다.
업데이트 이력
- 2026-09-28 — 최초 발행. 모든 가격은 같은 날 Anthropic 공식 가격 페이지, Opus 5.5 발표문, Claude Platform 릴리스 노트와 대조했습니다. 작업 형태별 비용은 정가에 대한 계산값이며 실제 청구 측정값이 아닙니다.
이 분야의 가격은 자주 바뀝니다. 수치는 2026년 9월 28일 기준 Anthropic 공식 출처를 반영하며, 예산을 잡기 전에 가격 페이지를 다시 확인하십시오.
Related Research
- Claude Fable 5 차단과 복구 경위: 6~7월 수출통제 사태의 전말과, 정가를 포함한 현재 Claude 모델 구성을 정리했습니다.
출처: Anthropic — Claude API 가격 · Anthropic — Introducing Claude Opus 5.5 · Anthropic — Claude Platform 릴리스 노트 · Anthropic — Extended Thinking
최종 확인: 2026년 9월
실측 핵심 수치
자주 묻는 질문
Claude Opus 5.5의 가격은 얼마입니까?
Opus 5.5가 Opus 5보다 저렴합니까?
Claude Opus 5.5에서 생각 모드를 끌 수 있습니까?
생각 토큰은 출력으로 과금됩니까?
Opus 5.5가 Opus 5보다 비싸지는 시점은 언제입니까?
Opus 5.5와 Sonnet 5의 가격은 어떻게 다릅니까?
Opus 5.5의 fast mode는 더 비쌉니까?
출처 및 1차 자료
- Anthropic — Claude API pricing (official)platform.claude.com
- Anthropic — Introducing Claude Opus 5.5www.anthropic.com
- Anthropic — Claude Platform release notesplatform.claude.com
- Anthropic — Extended thinking (billing of thinking tokens)platform.claude.com
교육용 콘텐츠이며 투자 권유나 금융 조언이 아닙니다. 데이터·가격·도구 사양은 바뀔 수 있으니, 실거래 전 직접 검증하고 페이퍼 트레이딩으로 확인하시기 바랍니다.
