
Claude Opus 5.5의 API 가격은 입력 100만 토큰당 4달러, 출력 20달러다. 직전 모델 Opus 5보다 정확히 20% 내린 값이다. Anthropic이 내세운 ‘40% 저렴’은 이 단가 인하에 캐시 할인과 작업당 토큰 감소를 더한 수치다. 그리고 두 모델의 기본 설정끼리 비교한 결과다.
이 글의 가격은 2026년 9월 23일 확인 기준입니다. 원화 환산은 2026년 9월 22일 서울외환시장 주간거래 종가인 1달러 = 1,358.2원을 적용했습니다.
📌 확정 — 공식 발표로 확인된 내용 · 📢 발표 — 회사가 밝혔으나 독립 검증 전 · 🔎 분석 — Hoonyspot의 계산과 판단
9월 22일 공개된 Opus 5.5, 무엇이 달라졌나
📌 Anthropic은 2026년 9월 22일(미국 현지 기준) Opus 5.5를 공개했다. Reuters와 Bloomberg, TechCrunch가 같은 날 출시를 보도했다. Claude가 사내 AI 연구개발의 26%를 주도한다는 R&D 자동화 지표를 내놓은 지 닷새 만이다.
라인업에서 자리는 Sonnet 5와 최상위 Fable 5.1 사이다. API 모델 이름은 claude-opus-5-5이다. Claude API, claude.ai, Claude Code에서 바로 쓸 수 있고 Amazon Bedrock, Google Cloud Vertex AI, Microsoft Foundry에도 올라갔다.
컨텍스트 창은 100만 토큰, 최대 출력은 12만 8천 토큰이다. 학습 데이터 기준 시점은 2026년 6월이다. 📢 출력 생성 속도는 Opus 5보다 30% 이상 빠르다고 회사는 밝혔다.
| 100만 토큰당 (USD) | Opus 5.5 | Opus 5 | Fable 5.1 |
|---|---|---|---|
| 입력 | $4 | $5 | $10 |
| 출력 | $20 | $25 | $50 |
| 캐시 읽기 | $0.20 | $0.50 | $0.25 |
| 캐시 쓰기(5분) | $5 | $6.25 | $12.50 |
📌 Anthropic 공식 발표 기준. 2026년 9월 23일 확인.
‘40% 저렴’은 세 가지가 겹친 숫자다
표시 단가만 보면 인하 폭은 20%다. 나머지는 두 군데서 나온다.
첫째, 토큰 단가 20% 인하. 📌 입력은 5달러에서 4달러로, 출력은 25달러에서 20달러로 내렸다. 캐시를 전혀 쓰지 않고 두 모델이 같은 수의 토큰을 쓴다고 가정하면 절감률은 20%다.
둘째, 캐시 읽기 60% 인하. 📌 0.50달러에서 0.20달러로 떨어졌다. 코딩이나 에이전트 작업은 같은 코드와 지시문을 여러 번 다시 읽는다. 이 반복분이 캐시 읽기로 과금된다. 반복이 많은 작업일수록 절감 폭이 커지는 구조다.
셋째, 작업당 토큰 감소. 📢 같은 일을 더 적은 토큰으로 끝낸다는 회사 설명이다. 작업 종류마다 편차가 크고, 아직 독립 기관의 측정치는 나오지 않았다.
비교 조건을 확인해야 합니다
Anthropic의 40%는 기본 설정끼리 비교한 값입니다. Opus 5.5의 기본 추론 강도(effort)는 medium, Opus 5는 high였습니다. 회사는 한 단계 낮은 설정의 5.5가 5의 high와 같거나 나은 결과를 낸다고 설명합니다. 공식 문구는 “at default settings it will cost 40% less than Opus 5 on typical workloads”입니다.
🔎 뒤집어 보면 함정이 있다. Opus 5에서 effort를 high 이상으로 고정해 썼다면 그 설정을 그대로 옮기지 않는 편이 좋다. Anthropic은 같은 effort 값에서도 5.5가 5보다 더 많이 생각할 수 있다며, 기본값인 medium부터 다시 평가하라고 권한다. 기존 설정을 유지하면 회사가 제시한 40% 절감이 그대로 재현되지 않을 수 있다.
같은 토큰을 썼을 때 비용은 얼마나 줄까
🔎 두 가지 작업을 가정하고, 두 모델이 같은 양의 토큰을 쓴다는 전제로 표시 단가만 적용했다. 실제로 두 모델에 작업을 돌린 결과가 아니라 가격 계산이다. 작업당 토큰 감소 효과는 넣지 않았으므로 실제 청구액은 이 표보다 낮게 나올 수 있다.
작업 A — 문서 여러 개를 한 번에 넣고 분석하는 단발 작업
입력 100만 토큰 + 출력 20만 토큰, 캐시 없음
| 모델 | USD | 원화 |
|---|---|---|
| Opus 5.5 | $8.00 | 약 10,870원 |
| Opus 5 | $10.00 | 약 13,580원 |
| Fable 5.1 | $20.00 | 약 27,160원 |
| GPT-6 Sol | $4.00 | 약 5,430원 |
계산식: 입력 단가 × 1 + 출력 단가 × 0.2
같은 토큰 수를 쓰고 캐시가 없다면 Opus 5 대비 절감은 정확히 20%다.
작업 B — 같은 코드 저장소를 반복해서 고치는 에이전트 작업, 월 100회
1회당 캐시 읽기 800만 + 새 입력 40만 + 캐시 쓰기 60만 + 출력 30만 토큰
| 모델 | 1회 | 월 100회 | 월 원화 |
|---|---|---|---|
| Opus 5.5 | $12.20 | $1,220 | 약 166만 원 |
| Opus 5 | $17.25 | $1,725 | 약 234만 원 |
| Fable 5.1 | $28.50 | $2,850 | 약 387만 원 |
계산식: 캐시 읽기 단가 × 8 + 입력 단가 × 0.4 + 캐시 쓰기 단가 × 0.6 + 출력 단가 × 0.3
이 가정에서는 Opus 5 대비 약 29%, 한 달 약 69만 원이 줄어든다. 캐시 비중이 클수록 절감이 커진다는 게 숫자로 드러난다. Anthropic이 밝힌 40%는 회사가 정의한 전형적 작업에서 기본 설정끼리 비교한 결과다. 실제 절감률은 캐시 비중과 작업당 토큰 사용량에 따라 달라진다.
📢 초기 고객사 가운데는 토큰 사용량이 Opus 5의 절반에서 3분의 1 수준이었다는 사례도 있다. 다만 회사가 공개한 고객 발언이고, 제3자가 같은 조건으로 재현한 수치는 아니다.

경쟁 모델 옆에 두면 여전히 비싼 쪽이다
같은 날 OpenAI는 GPT-6 Sol을 입력 2달러, 출력 10달러에 내놨다. 표시 단가로는 Opus 5.5의 절반이다. xAI의 Grok 4.7(입력 2달러·출력 6달러)과 Google의 Gemini 3.1 Pro(입력 2달러·출력 12달러)도 단가가 더 낮다.
🔎 그래도 단가표만으로 결론을 내리기는 이르다. 위의 Grok 4.7과 Gemini 3.1 Pro 가격은 프롬프트 20만 토큰 이하 구간이다. 이를 넘으면 Grok 4.7은 입력 4달러·출력 12달러, Gemini 3.1 Pro는 입력 4달러·출력 18달러로 오른다. 저가 구간 단가만 놓고 비교하면 긴 문서 작업에서는 차이가 과장될 수 있다. 같은 일을 몇 토큰으로 끝내는지도 모델마다 다르다.
계산 방식은 앞서 정리한 Grok 4.6 가격 비교와 같다. 모델 세대가 바뀌어 숫자를 새로 넣었다.
성능 수치는 어떤 조건에서 나왔나
| 벤치마크 | Opus 5.5 | Opus 5 | 비교 대상 최고 |
|---|---|---|---|
| Terminal-Bench 4.0 에이전트 코딩 | 66.4% | 52.3% | 57.9% (GPT-6 Astra) |
| OSWorld 2.0 (partial) 컴퓨터 조작 | 81.8% | 74.0% | 80.7% (Fable 5.1) |
| AutomationBench 업무 자동화 | 40.0% | 26.9% | 41.4% (GPT-6 Astra) |
📢 Anthropic 발표 기준. GPT-6 Astra 수치는 OpenAI 자체 보고값.
이 표는 세 가지를 알고 읽어야 한다. 우선 점수는 대부분 최대 추론 강도(max)에서 측정됐다. 40% 절감이 나온 기본 설정(medium)과는 다른 조건이다. 최고 점수와 최저 비용을 한 설정에서 동시에 얻는 게 아니라는 뜻이다.
다음으로, Opus 5.5가 모든 항목에서 1위는 아니다. 업무 자동화 벤치에서는 GPT-6 Astra가 근소하게 앞섰다. 마지막으로 Anthropic 스스로도 이 수준에서는 점수 차이가 실사용 차이를 그대로 반영하지 않는다고 밝혔다.
claude.ai 구독자에게 달라지는 것
API를 쓰지 않는 Pro·Max 이용자에게 직접 닿는 변화는 사용 한도다. 📌 Anthropic은 Opus 5.5 출시와 함께 Pro·Max·Team 등 구독 플랜의 5시간 사용 한도를 늘렸다. 공식 발표에는 구체적인 증가율이 없다.
구독자에게는 사용 한도를 한 번 초기화할 수 있는 리셋 기회도 주어졌다. 보도에 따르면 10월 22일까지 쓸 수 있다.
🔎 Claude Code에서 effort를 직접 지정해 쓰던 경우라면 설정을 한 번 비워 볼 만하다. 기본값인 medium으로 결과부터 확인하고, 부족할 때만 올리는 편이 비용 면에서 낫다.

누구에게 의미 있는 변화인가
이미 Opus 5로 코딩·에이전트 작업을 돌리던 경우가 가장 큰 수혜층이다. 같은 토큰량을 가정해도 비용이 20% 이상 줄고, 캐시 비중이 큰 작업일수록 폭이 커진다. 작업당 토큰까지 줄어들면 절감은 더 커질 수 있다.
Fable 5.1을 쓰던 경우 입력·출력 단가와 캐시 쓰기 단가는 40% 수준으로 내려간다. 다만 캐시 읽기는 0.25달러와 0.20달러로 차이가 작다. 캐시 비중이 큰 작업일수록 절감 폭이 줄어드는 구조다. 성능 격차가 크지 않다는 회사 설명을 감안하면 일부 작업을 옮겨 볼 만하지만, 먼저 자기 작업으로 직접 비교해 보는 게 순서다.
단가가 가장 중요한 대량 처리라면 계산상 여전히 GPT-6 Sol이나 Sonnet 5 같은 저가 모델이 유리하다. 40% 절감은 Opus 등급 안에서의 이야기다.
가끔 대화만 하는 가벼운 이용자라면 체감 변화는 크지 않다. 한도가 늘어난 정도로 받아들이면 된다.

이 글의 가격과 한도는 발표 시점 기준이며 바뀔 수 있습니다. 실제 청구액은 캐시 적중률, 배치 처리 여부, 추론 토큰 사용량에 따라 달라집니다. 도입 전 각 사 공식 가격 페이지를 다시 확인하시기 바랍니다.

참고자료
- Anthropic, Claude Opus 5.5 공식 발표 — anthropic.com
- Reuters, Opus 5.5 출시 보도 — reuters.com
- TechCrunch, Opus 5.5 가격·성능 보도 — techcrunch.com
- VentureBeat, GPT-6 Sol 출시 보도 — venturebeat.com
- The New Stack, 캐시 가격·구독 한도 보도 — thenewstack.io
- xAI 개발자 문서, Grok 가격 — x.ai
- Google, Gemini API 가격 — ai.google.dev
- OpenAI, GPT-6 Sol 가격 — openai.com
- 머니투데이, 9월 22일 원·달러 환율 종가 — mt.co.kr