TabbitBlog

Claude Opus 5.5 가격: $4/$20 요금표와 실제 청구서

Claude Opus 5.5 가격 완전 정리: $4/$20 요금표 전체, 캐시 읽기 60% 인하, $0.55–$5.98 effort 비용 사다리, 구독 규칙, 실제 계산 예시, 로컬 계산기.

이 글의 목차
  1. Key takeaways
  2. Claude Opus 5.5 가격 한눈에 보기
  3. 바뀐 숫자: 캐시 읽기 60% 인하
  4. "40% 저렴"의 실제 의미
  5. effort 레버: 과제당 $0.55에서 $5.98까지
  6. 헤드라인 밖의 과금 항목
  7. 패밀리 사다리: Opus 5.5 vs Fable 5.1 vs Opus 5 vs Sonnet 5
  8. 돈을 내지 않는 것들
  9. 플랜 가용성: API, 클라우드, 소비자 플랜
  10. 계산 예시 두 가지, 모든 가정을 드러내며
  11. 실용적인 선택지: Tabbit에서 비교 실행하기
  12. Claude Opus 5.5 가격 의사결정표
  13. 최종 평결
  14. Sources

Claude Opus 5.5는 Anthropic API에서 백만 입력 토큰당 $4, 백만 출력 토큰당 $20이며, 캐시 읽기는 백만당 $0.20입니다. 모든 요금은 2026년 9월 23일(출시 다음 날) Anthropic 자체 가격 문서에서 확인했습니다. 이번에는 요금표 자체가 뉴스입니다. Opus 5 대비 5개 과금 항목 전부가 내렸고, 전세대보다 싸진 최초의 Opus 세대입니다. 4.5부터 5까지 다섯 세대의 Opus가 모두 $5/$25를 유지해 왔는데, 최신 세대가 갑자기 가장 싸진 셈입니다. Anthropic의 공식 추정: "기본 설정에서 일반적인 워크로드 기준 Opus 5보다 40% 저렴할 것"입니다.

이 문장의 양쪽 절반 모두 사실이고, 그 사이의 간극이 이 글이 존재하는 이유입니다. 공식 요금표에서 기여가 가장 큰 한 줄은 캐시 읽기 — 60%가 내려 Sonnet 5와 같은 $0.20이 됐습니다. 요금표 밖에서는, r/ClaudeCode의 한 개발자가 출시 당일 Artificial Analysis를 열고 Opus 5.5가 "AA Intelligence Index 과제당 비용에서 Opus 5보다 비싸게 나타난다"는 화면을 본 뒤 스스로 답을 찾았습니다. "max effort 추론을 쓰지 마세요. max만 안 쓰면 더 쌉니다"(r/ClaudeCode). 이 페이지는 Opus 5.5 이야기 중 돈에 관한 부분입니다. 능력 배경은 패밀리 개요Opus 4.8의 현황에 있고, 가이드 후반에는 예산이 정리된 뒤 비교를 실행할 실용적 장소로 Tabbit Browser가 등장합니다. 먼저 숫자입니다.

Key takeaways

  • 요금표: 백만 토큰당 입력 $4, 캐시 읽기 $0.20(0.05x — 이 모델만의 요금), 캐시 쓰기 $5/$8(5분/1시간), 출력 $20. Batch는 모두 반값 $2/$10, Fast 모드는 모두 두 배 $8/$40, US-only 추론은 모든 항목에 1.1x.

  • 인하는 대부분 하나의 숫자에서 왔다. 캐시 읽기가 60% 하락($0.50 → $0.20) — Anthropic 스스로 "에이전트·코딩 작업 비용의 대부분을 차지한다"고 말하는 항목입니다. Opus 5.5의 캐시 읽기는 이제 Sonnet 5와 같은 가격인데 모델은 두 수준 위입니다.

  • effort가 가장 큰 통제 가능한 레버. Artificial Analysis는 low에서 과제당 $0.55, max에서 $5.98을 측정했습니다. 지능 16점을 위해 11배의 비용 진폭. 기본값은 medium이고, 같은 설정에서도 Opus 5보다 턴당 더 많이 생각합니다.

  • 긴 컨텍스트 벼랑 없음. 100만 토큰 전체 창이 표준 요금으로 과금되고, Batch 베타 헤더는 30만 출력 토큰까지 허용합니다. 다만 4.7 이후의 새 토크나이저는 같은 텍스트에 약 30% 더 많은 토큰을 만듭니다.

  • 구독도 함께 갱신. Opus 5.5는 Pro/Max에서 표준 할당량으로 계상됩니다(Fable은 주간 한도 50%의 usage credits를 소모). 유료 플랜의 5시간 한도가 인상됐고, 한도 초기화는 저장해 두었다가 쓸 수 있게 됐습니다.

Claude Opus 5.5 가격 한눈에 보기

2026년 9월 23일 Anthropic 가격 문서에서 가져온 표준 요금 전체입니다:

모델입력 / 100만5m 캐시 쓰기 / 100만1h 캐시 쓰기 / 100만캐시 읽기 / 100만출력 / 100만
Claude Opus 5.5$4.00$5.00$8.00$0.20$20.00
Claude Fable 5.1$10.00$12.50$20.00$0.25$50.00
Claude Opus 5$5.00$6.25$10.00$0.50$25.00
Claude Sonnet 5$2.00$2.50$4.00$0.20$10.00
Claude Haiku 4.5$1.00$1.25$2.00$0.10$5.00
Anthropic 공식 모델 가격표. Claude Fable 5.1, Claude Opus 5.5, Claude Opus 5 등의 기본 입력, 5분 및 1시간 캐시 쓰기, 캐시 히트, 출력 요금 수록
2026년 9월 23일 기준으로 표시된 Anthropic 공식 모델 가격표.

이 표에서 주목할 것은 세 가지이고, 어느 것도 헤드라인의 $4가 아닙니다:

  1. 캐시 읽기에 전용 배율이 생겼다. 다른 표준 모델의 읽기는 기본 입력의 0.1x, Fable 5.1과 Mythos 5.1은 0.025x, Opus 5.5는 Anthropic 각주에 따라 그 사이인 0.05x입니다. 결과는 $0.20 — Sonnet 5의 캐시 읽기와 동일합니다.

  2. 출력은 여전히 입력의 5배. 이 모델은 적응형 사고를 끌 수 없고, 사고 토큰은 과금 대상 출력입니다. 짧은 프롬프트와 긴 추론 사슬은 입력 복장을 한 출력 청구서입니다.

  3. 토크나이저는 두 세대 전에 바뀌었다. Claude 4.7 이후 모델은 같은 텍스트에 약 30% 더 많은 토큰을 생성합니다(Anthropic 자체 각주). Opus 4.6 시대 요금과 토큰 단가를 직접 비교하면 구형 모델 비용을 3분의 1만큼 과대평가하게 됩니다.

하나 더: 100만 토큰 전체 창이 표준 요금으로 과금됩니다. 긴 컨텍스트 구간은 없습니다. 임계값을 넘으면 요청 전체가 재가격되는 GPT-6 Astra의 272K 벼랑과 달리, Opus 5.5에서는 Anthropic 표현대로 "90만 토큰 요청이 9천 토큰 요청과 같은 토큰당 요금으로 과금"됩니다.

바뀐 숫자: 캐시 읽기 60% 인하

Opus 5에서 Opus 5.5로 가는 동안 5개 과금 항목이 움직였지만, 에이전트 작업에 결정적인 것은 읽기 항목입니다. 백만당 $0.50 → $0.20, 60% 인하와 새로운 0.05x 배율.

메커니즘: 요청이 이전에 처리한 프롬프트 접두사 — 시스템 프롬프트, 저장소 컨텍스트, 대화 기록, 도구 정의 — 를 반복하면 API는 재처리 대신 캐시에서 해당 접두사를 읽습니다. 쓰기는 5분 항목에 기본 입력의 1.25x(이 모델에서 $5/100만), 1시간 항목에 2x($8/100만)입니다. 읽기는 기본의 0.05x — $0.20/100만 — 이 모델뿐입니다. 캐시는 5분 재읽기 1회 또는 1시간 재읽기 2회로 본전이고, 배율은 Batch 및 데이터 레지던시와 중첩되며, 캐시 가능한 최소 프롬프트는 512 토큰입니다.

이것이 에이전트 청구서를 지배하는 이유: 20만 토큰 컨텍스트에서 도구를 40번 호출하는 에이전트는 그 접두사를 40번 다시 읽습니다. Opus 5의 $0.50/100만이면 재읽기에 $4.00, Opus 5.5의 $0.20/100만이면 $1.60입니다 — 새 토큰을 하나도 생성하기 전에. Anthropic의 출시 페이지 자체가 이 항목을 가리킵니다. 캐시 읽기는 "에이전트·코딩 작업 비용의 대부분을 차지"하며, 60% 인하가 공식 40% 주장에서 가장 큰 몫입니다.

같은 이야기의 구독 쪽 현장:

r/ClaudeCode 게시물과 댓글. Opus 5.5 비용을 논하며, xhigh와 max에서 여러 스레드를 돌려도 사용량 게이지가 거의 움직이지 않는다는 보고
r/ClaudeCode, 출시 당일: 작성자의 max effort 질문과 커뮤니티 사용량 보고. 개인 구독 경험이며 플랜은 미상.

"Usage drains so slowly with opus 5.5. Have multiple threads going on xhigh and max and the usage bar is hardly budging"라는 답글이 있고, 다른 사용자는 큰 작업 두 개를 하고도 주간 할당량이 거의 움직이지 않았다고 보고했습니다. 자기 보고형 플랜 경험이지 벤치마크가 아닙니다. 그러나 API 수학과 같은 방향을 가리킵니다. 에이전트 예산은 읽기 항목에 살아 있습니다.

늘 그렇듯 함정도 같습니다. 캐시 절약은 안정된 접두사를 요구합니다. 컨텍스트가 매 턴 바뀌면 — 동적 도구 출력, 순환 문서 — 0.05x 읽기를 타는 대신 1.25x~2x 쓰기 페널티를 반복해서 지불합니다. 또한 Opus 5.5의 thinking 블록은 모델과 대화에 묶여 있어 접두사를 편집하면 무효화됩니다. 다음 절의 축소판입니다.

"40% 저렴"의 실제 의미

Anthropic의 출시 주장에는 세 가지 정확한 조건이 있고, 이를 해석하는 것이 예산과 희망의 차이입니다. "당사 테스트에 따르면 기본 설정에서 일반적인 워크로드 기준 Opus 5보다 40% 저렴합니다."

조건 1: 기준선은 Opus 5이지, 경쟁사도 Fable도 아닙니다. 이 주장은 두 효과의 합성입니다. 약 20%의 요금 인하에 과제당 토큰 감소("Opus 5보다 토큰당 싸고 과제당 토큰도 적게 써, 합쳐서 비용이 40% 감소"). Anthropic 자체 예시도 같은 밴드 이상에 놓입니다. HAProxy의 C→Rust 재작성은 9.5시간에 끝났고 Fable 5.1은 12시간, 비용은 51% 절감. 20만 줄 코드베이스 감사는 3시간 미만, Opus 5는 20시간 이상에 토큰 2.5배. 이름을 밝힌 얼리 테스터들은 4050% 비용 절감(Spotify), 절반 토큰(Kiro), 3분의 1 토큰(Box), "처음으로 medium을 기본으로 삼은 모델"(Factory)을 보고했습니다. HN 댓글 하나가 추세선을 말합니다. "단 3주 전 자사 출시 대비 성능/비용 비율을 약 36배 끌어올린 출시"(Hacker News).

조건 2: "기본 설정"은 medium effort. max에서는 수학이 뒤집힙니다. 공식 동작 노트에 따르면 "같은 effort 설정에서도 이 모델은 Claude Opus 5보다 턴당 더 많이 생각하는 경향이 있고, 특히 xhigh와 max에서 그렇습니다". 과금되는 사고가 예산의 치명타입니다. r/ClaudeAI 비교 스레드가 그 형태를 정량화했습니다. "max effort에서 AA는 Opus 5.5의 과제당 약 11.9만 출력 토큰을 측정. [GPT-6] Sol은 약 3.1만을 쓰고 전체 인덱스 실행에 과제당 $1.06":

r/ClaudeAI 게시물. Opus 5.5와 GPT-6 Sol 벤치마크를 비교하며 max effort에서 Opus 5.5가 과제당 약 11.9만 출력 토큰을 쓴 반면 Sol은 3.1만이었다고 지적
r/ClaudeAI: 같은 날 출시된 비교. AA 데이터의 커뮤니티 독해이며 통제된 벤치마크가 아님.

조건 3: "일반적인 워크로드"는 당신의 것이 아닐 수 있다는 뜻. 커뮤니티는 여기에 상처를 안고 있고, 그 상처에는 가격이 붙어 있습니다. 출시 뉴스 스레드의 최다 추천(226점) 댓글:

r/ClaudeAI 댓글. 사용자들이 Opus 5 출시 당시 토큰 효율 주장을 회상하며 소통 문제로 낭비된 시간과 토큰을 이야기
r/ClaudeAI 출시 스레드: Opus 5 출시 주장의 회상. 주관적 경험이지 측정이 아님.

"Opus 5가 처음 나왔을 때 그들은 모델이 얼마나 최첨단인지 계속 주장했다…… 한참 쓰고 보니 Opus 5는 제대로 소통조차 못했다…… 왕복 투쟁에 많은 이가 자신을 의심했고, 더 많은 시간과 토큰을 낭비했다." 같은 네트워크의 회의론자들은 AA 차트를 반대로 읽습니다. "opus 5.5는 astra를 이겼다……하지만 같은 작업에 4.5배 토큰을 썼다" — 옹호론자는 "opus 5.5 medium이 Astra max와 같은 성능에 2.5배 저렴"이라고 읽습니다. 둘 다 같은 출시를 읽고 있습니다. 당신의 청구서가 어느 쪽을 닮을지는 어떤 토큰이 지배하느냐에 달렸고, 그것을 측정하는 것이 다음 절입니다. 이 트레이드오프의 능력 측면은 Fable 5.1 리뷰에이전틱 추론 가이드에 있습니다.

effort 레버: 과제당 $0.55에서 $5.98까지

요금표 어디에도 이 다이얼이 어떤 가격 항목보다 비용을 크게 움직인다고 말해주지 않습니다. Artificial Analysis는 Opus 5.5를 5개의 별도 항목으로 추적합니다. 2026년 9월 23일 스냅샷:

effortIntelligence IndexII 과제당 비용출력 속도
low42$0.5583 t/s
medium(기본)51$1.3476 t/s
high54$1.8290 t/s
xhigh56$3.4676 t/s
max58$5.98

양 끝 열을 함께 읽으세요. max는 과제당 low의 10.9배 비용이 들고, 측정 지능은 16점 차이입니다. medium — 기본값 — 은 Opus 5 max와 같은 지능 지수를 냅니다($1.34 대 Opus 5 최상위 가격). r/ClaudeCode 스레드의 최다 추천 답글이 정확히 이것입니다. "max는 xhigh의 거의 두 배 비용이고 다른 레벨에서 벗어난 이상치. medium이나 high를 쓰면 실질적인 비용 절감이 있을 것." 그곳의 한 개발자는 이미 이 사다리를 축으로 워크플로를 재구성했습니다. "Opus 5.5 High는 정말 좋다. fable 5.1 medium 같은데 훨씬 싸…… 워크플로를 바꿔 대부분의 작업을 Opus 5.5 high로 옮겼다."

다이얼을 돌리기 전 주의 두 가지. 첫째, 이관: 기본값이 high(Opus 5)에서 medium으로 바뀌었고, 같은 설정에서도 새 모델은 턴당 더 많이 생각합니다. Anthropic 문서는 설정을 그대로 가져오지 말고 effort 스윕을 다시 돌리며 max_tokens에 사고 여유를 남기라고 명시합니다. 둘째, 높은 effort가 품질을 안정적으로 사 주지는 않습니다. CodeRabbit의 출시 당일 평가에서는 "더 높은 추론 effort가 일관되게 더 나은 완료율을 가져다주지 않았다" — 그리고 개발자가 평가해야 할 코멘트가 늘어나는 것 자체가 비용입니다:

CodeRabbit의 YouTube 영상. Opus 5.5 평가 결과가 엇갈렸음을 설명하고 더 높은 추론 effort가 일관되게 더 나은 완료를 가져오지 않았다고 지적
CodeRabbit 출시 당일 평가 영상: 단일 벤더 벤치마크이며 방법론은 영상 내에 있음.

출시 페이지의 고객 인용도 같은 방향입니다. Rogo는 "가장 낮은 effort 설정에서 Opus 5의 high를 이기고…… 출력 토큰은 약 60% 감소", Walleye Capital은 최저 설정에서 평가 스위트를 "대부분 해결". 벤더 자신의 증거가 계속 싼 설정을 가리킬 때, 그것을 기본 답으로 삼고 max는 명백히 필요한 과제에만 남겨두세요.

헤드라인 밖의 과금 항목

다섯 항목이 실제 청구서의 대부분을 결정하고, 출시 보도에 등장하는 것은 첫 번째뿐입니다.

Fast 모드: 모든 항목 2배, 최대 2.5배 속도. Fast(리서치 프리뷰, Claude API 전용)는 입력 $8 / 출력 $40으로 과금됩니다. 표준 카드의 두 배이고 캐시 항목도 포함입니다(읽기 $0.40). 캐시·데이터 레지던시와 중첩되고 Batch와는 조합 불가능하며, 출력은 "최대 2.5배" 빨라집니다. OpenRouter 제공자 표는 Fast에서 143 tok/s(표준 71~83)를 측정했습니다. 눈여겨볼 점: Fast Opus 5.5의 출력 $40/100만은 Fable 5.1 표준 $50보다 여전히 낮습니다.

Batch: 50% 레버. 비동기 Batch 요청은 $2/$10으로 과금됩니다. 카드에서 가장 큰 할인이고, 컨텍스트 창 전체에서 프롬프트 캐시와 중첩되며, 베타 헤더로 최대 30만 출력 토큰이 가능합니다. 관리형 에이전트 세션은 대상이 아닙니다. 상태를 가지고 대화형이기 때문입니다.

US-only 추론: 모든 범주 1.1x. inference_geo: "us"를 설정하면 입력, 출력, 캐시 쓰기, 캐시 읽기 모든 범주에 1.1x가 곱해집니다. 같은 10%는 파트너 클라우드의 리전 엔드포인트 가격으로도 나타나며, OpenRouter는 Bedrock/Azure/Vertex 리전 라우트를 $4.40/$22.00/$0.22로 게시합니다. 컴플라이언스가 필요한 리전은 매 항목마다 조용히 1할의 프리미엄을 내고, 글로벌 라우팅이 기본이자 싼 길입니다.

도구 오버헤드는 토큰 청구서다. 도구 사용 시스템 프롬프트는 요청당 286 토큰(Opus 4.7의 675에서 감소). 브라우저 도구세트 선언은 약 6,600 입력 토큰, computer use는 약 4,500을 추가합니다. 서버 측 웹 검색은 토큰 외에 1,000회당 $10. 코드 실행은 검색/페치와 함께면 무료이고 매월 1,550시간 무료 컨테이너 시간 후 $0.05/시간입니다. "에이전트"는 가격 구조이지 대화가 아닙니다. 도구 항목은 명시적으로 예산을 잡으세요. 예산 쪽 비교는 Kimi K3 가격 분해에 있습니다.

Managed Agents 런타임: 세션 시간당 $0.08. running 상태에서만 계상되며 모든 토큰 항목은 모델 가격. Batch는 세션에 적용되지 않습니다.

패밀리 사다리: Opus 5.5 vs Fable 5.1 vs Opus 5 vs Sonnet 5

항목(100만 토큰당)Opus 5.5Fable 5.1Opus 5Sonnet 5
입력$4.00$10.00$5.00$2.00
캐시 읽기$0.20(0.05x)$0.25(0.025x)$0.50(0.1x)$0.20(0.1x)
출력$20.00$50.00$25.00$10.00
Batch 입력 / 출력$2.00 / $10.00$5.00 / $25.00$2.50 / $12.50$1.00 / $5.00
AA Intelligence Index(max)58535138
AA 과제당 비용(max)$5.98$7.63¹

¹ Fable 5.1 수치는 AA의 9월 22일 스냅샷이며 당사의 Fable 가격 분해 경유. AA 두 페이지는 매일 변합니다.

직관에 반하는 행은 마지막 행입니다. Artificial Analysis 지수에서 더 싼 모델이 이제 더 강한 모델이기도 합니다. Opus 5.5 max는 Fable 5.1의 53에 대해 58점을 얻었고 과제당 비용은 $5.98 대 $7.63 — 그런데도 Anthropic 자체 포지셔닝은 Fable을 "야심적이고 장시간 실행되는 비동기 작업"에 계속 배치하며 Opus와 Fable의 격차를 "이 점수가 시사하는 것보다 좁다"고 말합니다. 이렇게 읽으세요. 점수는 격차를 과장하지만 가격 격차는 실재하며 뒤집혔습니다. 캐시된 컨텍스트 루프는 더 가깝습니다. Fable은 가장 깊은 읽기 할인(0.025x)을 유지하지만 읽기는 $10 기준에서 출발하는 $0.25/100만. Opus 5.5의 $0.20이 절대값에서 앞섭니다.

같은 AA 차트에 대한 두 커뮤니티 독해를 나란히:

X 스레드. 한 사용자는 opus 5.5 medium이 Astra max와 같은 토큰·같은 성능에 2.5배 저렴하다 말하고, 인용된 게시물은 opus 5.5가 같은 작업에 4.5배 토큰을 썼다고 지적
X: 같은 AA 데이터의 두 독해 — 가성비 선택 vs 토큰을 먹는 플래그십. 개인적 차트 해석.

"same tokens … same performance opus 5.5 med vs Astra max — 2.5x cheaper" 대 "opus 5.5가 astra를 이겼다……하지만 4.5배의 토큰을 썼다". 둘 다 같은 형태를 설명합니다. Opus 5.5는 완료 과제당 비용에서 이기고 과제당 토큰에서 집니다. 엄격한 토큰 예산, 서드파티 라우터, 처리량 상한 같은 토큰 형태에 민감한 워크로드라면 이관 전에 측정하세요. 과제 형태라면 사다리는 거의 모든 단에서 Opus 5.5로 기울어 있습니다.

플래그십 아래에서는 Sonnet 5가 $2/$10로 예산 자리를 지키고, 읽기 $0.20 — 이제 Opus 5.5와 같은 가격 — Haiku 4.5는 $1/$5를 유지합니다. 사다리의 새로운 논리: 캐시 읽기 열이 이만큼 압축되어 똑똑한 모델과 싼 모델이 에이전트가 가장 세게 치는 항목에 같은 값을 청구하게 되었다는 것입니다.

돈을 내지 않는 것들

문서의 경계는 환불 정책처럼 읽히며, 에이전트 규모에서는 중요합니다:

  • 버려진 thinking 블록은 과금되지 않는다. 요청이 모델이 읽을 수 없는 thinking 블록을 실으면 API는 추론 전에 이를 버립니다. "요청은 성공하고, 버려진 블록은 과금되지 않는다". 사고 블록이 대화에 묶인 모델에게 이것이 우아한 저하선입니다.

  • 세이프가드 우회는 다른 모델이 완료한다. 출시 페이지 벤치마크 각주에 따르면 사이버보안으로 분류된 요청은 Opus 4.8이 완료하며, 전환은 투명합니다(거부는 정책 영역이 담긴 stop_reason: "refusal"을 반환하고 서버 측 폴백이 추천 모델로 재시도). Anthropic은 Fable 때처럼 Opus 5.5의 우회 과금을 명시하지 않았습니다. 문서화될 때까지 완료 모델의 요금을 가정하는 것이 안전합니다.

  • 실패한 웹 검색은 과금되지 않는다. 성공은 1,000회당 $10. 에러는 무료입니다. 웹 페치는 가져온 콘텐츠의 토큰 외에 추가 요금이 없습니다.

  • 코드 실행은 검색 또는 페치와 함께면 무료이며, 매월 1,550시간의 무료 컨테이너 시간 후 시간당 $0.05가 시작됩니다.

플랜 가용성: API, 클라우드, 소비자 플랜

API 요금표는 세 경제권 중 하나일 뿐입니다. 2026년 9월 23일 claude.com/pricing과 플랫폼 문서에서 확인:

채널가격(확인된 표시값)Opus 5.5 접근
Anthropic API위 토큰 요금가능 — claude-opus-5-5
Free 플랜$0불가(Sonnet/Haiku만)
Pro연간 $17/월(선불 $200) 또는 월 $20가능 — 표준 할당
Max 5x / 20x$100부터/월가능 — 표준 할당
TeamStandard 좌석은 Pro 이상, Premium = 5x Standard가능
Enterprise연간 $20/좌석/월 + API 요금으로 사용량가능, 지출 통제 포함
클라우드AWS Bedrock, Google Cloud, Microsoft Foundry, Claude Platform on AWS가능. 리전 엔드포인트 +10%, Foundry는 CCU 과금

밑줄 칠 구독 행: 플랜 비교에서 Opus는 Pro/Max에서 표준 사용 할당으로 계상됩니다. "usage credits, 주간 한도의 50%" 별표가 붙는 것은 Fable입니다. Fable 1시간은 할당량에서 표준 모델 2시간어치를 소모합니다. Opus 5.5는 그렇지 않습니다. 출시 시점에 두 가지 변경이 더 쌓였습니다. Pro, Max, Team, 좌석 기반 Enterprise의 5시간 한도 인상과 "원할 때 저장해 두고 쓸 수 있는" 한도 초기화입니다.

이것이 실무에서 무엇을 의미하는지 커뮤니티는 갈라져 있고, 같은 스레드에 양방향이 보입니다:

r/singularity 댓글. 한 사용자는 Opus 5.5 비용이라면 주간 한도에 절대 안 닿는다 말하고, 다른 사용자는 API 가격 인하가 반드시 구독으로 전달되는 것은 아니라고 주장
r/singularity: 출시 당일 갈라진 구독 전망. 개인 사용 보고와 추측.

"I am using Fable 5.1 rn, and this is 5x cheaper for same intelligence? I am never going to hit my weekly limits at this rate" — 그리고 — "이 인하는 반드시 구독으로 전달되지 않는다…… API 비용을 마케팅 자료로 쓰면서 척도를 API 사용자에게 유리하게 옮기고 있다." 한도 인상은 문서화되어 있습니다. 얼마나 관대한지는 오직 자신의 5시간 창만이 답할 수 있습니다. 메커니즘상 사용량은 5시간 롤링 세션 창에서 초기화되고 유료 플랜은 주간 한도가 추가되며, 웹/데스크톱/모바일/Claude Code가 한 풀에서 소모하고, 유료 플랜의 usage credits로 한도 초과 후에도 표준 API 요금으로 계속 작업할 수 있습니다.

계산 예시 두 가지, 모든 가정을 드러내며

표준 요금, 재시도 없음, 도구 없음, 세금 없음. 계산이지 예측이 아닙니다.

긴 사고를 동반한 짧은 질문. 입력 10,000 토큰, 출력 2,000:

(10,000 × $4 + 2,000 × $20) / 1,000,000 = $0.08

큰 저장소에서의 콜드 에이전트 루프. 입력 300,000 토큰(표준 요금 — 긴 컨텍스트 구간 없음), 출력 8,000:

(300,000 × $4 + 8,000 × $20) / 1,000,000 = $1.36

같은 루프의 웜 버전. 같은 300,000 토큰 컨텍스트, 90% 캐시, 세션당 1회의 1시간 쓰기, 패스당 출력 8,000:

패스당: (270,000 × $0.20 + 30,000 × $4 + 8,000 × $20) / 1,000,000 = $0.334
일회성: 300,000 × $8 / 1,000,000 = 세션당 쓰기 $2.40

웜 패스는 콜드 비용의 4분의 1로 떨어지고 $2.40의 쓰기는 이를 재사용하는 모든 패스에서 상각됩니다. 5분 쓰기($1.50)는 재읽기 1회, 1시간 쓰기는 2회에 본전입니다. 접두사가 바뀌면 같은 루프는 매 패스 $1.36의 콜드 시작으로 돌아갑니다. 모델 리소스 (English)와 그 프롬프트 모음 (English)에 자신의 히트율을 측정할 수 있는 반복 가능한 과제가 있습니다.

로컬 계산

Claude Opus 5.5 API 토큰 비용 예상

2026-09-23에 확인한 공식 USD 요금을 사용합니다. 입력값은 브라우저에서만 처리됩니다.

작업당$0.08000
월간$0.08

캐시 히트는 100만 토큰당 0.20달러——Opus 5.5의 0.05배 요금입니다. 이 계산은 재시도, 도구 오버헤드, 세이프가드 재라우팅, 공급자 가산금을 제외합니다. Fast 모드는 모든 항목을 2배로 하며 Batch와 함께 쓸 수 없습니다. 최신 요금 확인

계산기는 완전히 이 페이지 안에서 돌아갑니다. 어디로도 아무것도 전송되지 않습니다. 두 캐시 쓰기 시점과 표준, Batch, US-only, Fast 네 모드를 계산하고 입력을 로컬에서 검증합니다. 의도적으로 모델링하지 않는 것: 재시도, 서브에이전트 팬아웃, 도구 오버헤드, 세이프가드 우회. 이것들은 여유분에 넣으세요. 예산을 확정하기 전에 공식 요금표를 다시 확인하세요. 본문은 2026년 9월 23일 기준 숫자입니다.

실용적인 선택지: Tabbit에서 비교 실행하기

예산 다음에는 지루한 부분이 옵니다. Opus 형태의 작업을 실제로 돌리려면 페이지, 파일, 모델 호출이 한곳에 있고 "Opus 5.5를 medium으로 시도하고 Sonnet으로 후퇴하기"가 오케스트레이션 프로젝트가 아니라 선택인 환경이 필요합니다. 그것이 Tabbit Browser가 차지한 자리입니다. 모델 피커, 라이브 탭, 로컬 파일이 한 화면을 공유하는 에이전틱 AI 브라우저입니다.

Tabbit Browser 새 탭의 모델 피커. 사용 가능한 모델 목록 표시

경계를 분명히 말합니다. Tabbit은 클라이언트이지 Anthropic 과금 계층이 아닙니다. 모델 가용성은 계정과 에디션에 달려 있고, 브라우저의 무엇도 Anthropic이 청구하는 금액을 바꾸지 않습니다. 위의 요금표는 Opus 5.5가 어디서 돌든 적용됩니다. 이 글은 Tabbit 안에서 Opus 5.5 과제를 실행하지 않았으므로 가용성이나 성능 주장을 하지 않습니다. 브라우저가 바꾸는 것은 셋업 비용입니다. 이 페이지 전체가 청구서를 결정한다고 말하는 두 숫자, 자신의 캐시 히트율과 effort 임계값을 실제 작업으로 측정하는 일은 그것을 위해 만들어진 작업 공간에서 가장 쌉니다. 방법은 Tabbit 작업 습관 가이드에 있습니다.

Tabbit Browser

Claude Opus 5.5 가격 의사결정표

당신의 워크로드비용 동인최적 출발점주의할 점
긴 에이전트 루프, 안정적인 저장소/문서 컨텍스트캐시 읽기표준 + 접두사 고정 + 1시간 쓰기접두사 편집은 묶인 thinking 블록을 무효화. 변동은 읽기를 1.25~2x 쓰기로 바꿈
짧은 대화, 빠른 편집출력 토큰더 낮은 effort — 또는 Sonnet 5사고는 끌 수 없음. 기본 medium이면 대부분 충분
밤샘 평가, 배치 리팩터볼륨Batch API $2/$10, 30만 출력 베타대화형·관리형 에이전트 세션은 제외
지연에 민감한 대화형 작업출력 속도Fast 모드 2x($8/$40), 캐시 병용Fast는 Batch와 조합 불가. 모든 항목을 두 배로
컴플라이언스가 요구하는 미국 내 처리모든 항목US-only 1.1x, 또는 클라우드 리전 엔드포인트(+10%)프리미엄은 캐시 읽기에도 적용
토큰 형태에 민감한 예산(라우터, 상한)과제당 토큰이관 전 측정Opus 5.5는 과제당 비용에서 이기고 과제당 토큰에서 짐
구독 기반 일상 사용5시간 창Pro/Max — Opus는 표준 할당이고 한도도 인상같은 플랜의 Fable은 주간 한도 50%의 usage credits 소모

최종 평결

Claude Opus 5.5는 전세대보다 싸진 최초의 Opus이며 인하는 모든 항목에서 실재합니다. 입출력 20% 감소, 에이전트 청구를 지배하는 캐시 읽기 60% 감소, 이제 Sonnet 5와 같은 가격. 장시간 에이전틱 코딩과 지식 작업을 위해 medium effort로, 접두사를 안정적으로, 기다릴 수 있는 작업은 모두 Batch에 맡기고 구매하세요. AA 지수에서는 Fable 5.1을 더 낮은 과제당 비용으로 앞질렀고 패밀리 사다리가 재편되었습니다. 그래도 고쳐지지 않는 두 청구서: max effort 사고(요금표에 결코 보이지 않는 11배 레버)와 토큰 형태에 민감한 예산(더 절제된 경쟁자보다 여전히 과제당 토큰이 많음). 구독에서는 할당량에 우호적인 플래그십입니다 — 표준 사용, 한도 인상 — 다만 팀을 확정하기 전에 자신의 5시간 소진을 확인하세요. 매월 공식 가격 페이지를 재확인하세요. Sonnet 5의 표준화와 이번 출시 모두 사다리가 빨리 움직인다는 증거입니다. 능력 이야기는 Fable 5.1 개요리뷰에, 위에 링크된 커뮤니티 기록이 워크로드 증거를 담고, 패밀리 간 가격 비교는 같은 표면 가격이 다른 곳에서 얼마인지 보여줍니다.

Sources

자주 묻는 질문

Claude Opus 5.5는 얼마인가요?

Anthropic API에서 Claude Opus 5.5는 백만 입력 토큰당 $4, 백만 출력 토큰당 $20입니다(2026년 9월 23일 Anthropic 가격 문서에서 확인). 프롬프트 캐시 쓰기는 백만당 $5(5분) 또는 $8(1시간), 캐시 읽기는 백만당 $0.20입니다. 이 0.05x 요금은 이 모델에만 적용됩니다. Batch API는 모두 반값인 $2/$10, Fast 모드는 모두 두 배인 $8/$40입니다.

Claude Opus 5.5가 Opus 5보다 싼가요?

요금표의 모든 항목이 내렸습니다. 입출력은 Opus 5의 $5/$25보다 20% 낮고, 캐시 쓰기는 $6.25/$10에서 $5/$8로, 캐시 읽기는 $0.50에서 $0.20으로 60% 낮아졌습니다. Anthropic은 기본 설정에서 일반적인 워크로드의 총 비용이 약 40% 감소할 것으로 추정합니다. 예외는 effort입니다. max에서는 턴당 더 많이 생각하며, 독립 측정의 과제당 비용은 low의 $0.55에서 max의 $5.98까지 — 표면 가격에는 보이지 않는 11배 폭입니다.

Claude Opus 5.5는 무료 플랜에서 쓸 수 있나요?

없습니다. Anthropic의 플랜 비교에서 Opus는 Free에서 이용 불가로 표시되며, Free는 Sonnet과 Haiku만 제공합니다. Opus 5.5는 Pro, Max, Team, Enterprise의 표준 할당량에 포함됩니다. 특히 Fable 5.1이 Pro/Max에서 적용받는 usage credits 방식이 아니라 표준 사용으로 계상됩니다. 출시와 함께 Pro, Max, Team, 좌석 기반 Enterprise의 5시간 사용 한도가 인상되었고, 저장했다가 원할 때 쓸 수 있는 한도 초기화도 추가되었습니다.

Claude Opus 5.5를 가장 싸게 쓰는 방법은?

레버를 순서대로 사용하세요. 프롬프트 접두사를 안정적으로 유지해 재읽기가 백만당 $4가 아니라 $0.20으로 과금되게 하고, 검수 기준을 통과하는 가장 낮은 effort에서 실행하며(기본값 medium이면 대부분 충분), 긴급하지 않은 작업은 Batch API의 $2/$10로 보내고, 컴플라이언스나 지연 요구가 없다면 US-only와 Fast 모드를 피하세요. 이관 시에는 effort 스윕을 다시 돌리세요. 같은 설정에서도 Opus 5.5는 Opus 5보다 턴당 더 많이 생각합니다.

Claude Opus 5.5는 긴 컨텍스트에 추가 요금이 있나요?

없습니다. 100만 토큰 전체 컨텍스트 창이 표준 토큰 단가로 과금되며 긴 컨텍스트 구간이 존재하지 않습니다. 프롬프트 캐시와 Batch 할인은 창 전체에 적용됩니다. Batch API에서는 베타 헤더로 최대 출력을 30만 토큰까지 올릴 수 있습니다. 단, Claude 4.7 이후 모델은 새 토크나이저를 사용해 같은 텍스트에 약 30% 더 많은 토큰을 생성합니다.

세이프가드 우회나 실패한 도구 호출은 Opus 5.5 가격으로 과금되나요?

세이프가드로 우회된 요청은 다른 모델이 완료합니다. Anthropic에 따르면 사이버보안으로 분류된 작업은 Opus 4.8이 처리하며, 전환은 조용히 과금되는 것이 아니라 투명하게 보고됩니다. 실패한 웹 검색은 전혀 과금되지 않고, 웹 페치는 가져온 콘텐츠의 토큰 외에 추가 요금이 없으며, 모델이 읽을 수 없는 thinking 블록은 추론 전에 버려지고 요금이 붙지 않습니다. 코드 실행은 웹 검색/페치와 함께 쓰면 무료이고, 단독 사용 시 매월 1,550시간의 무료 컨테이너 시간이 제공됩니다.

다음 단계

Tabbit 과 함께 일하세요.

탭 간 조사를 하고, 반복적인 브라우저 작업을 자동화하며, 모든 맥락을 손이 닿는 곳에 두세요.