Opus 5.5와 Sonnet 5.5의 가격과 1M 컨텍스트
v2.1.280부터 모든 구독 플랜이 Opus 5.5로 시작하고, Sonnet 5.5와 함께 1M 창이 기본이 되었습니다. 단가와 캐시를 넣은 요청 한 번의 비용, 창을 줄이는 방법을 비교합니다.
Pro 플랜에서 모델을 고른 적이 없다면 다음 세션은 Sonnet이 아니라 Opus로 열립니다. 단가만 보면 Opus 5.5는 Sonnet 5.5의 두 배입니다. 하지만 대화의 앞부분이 캐시로 읽히는 긴 세션에서는 요청 한 번의 차이가 1.2배 정도로 줄어듭니다. 기본값, 단가, 컨텍스트 창이 함께 바뀌어서 하나만 보면 비용을 잘못 읽기 쉽습니다.
모델을 고르지 않은 세션은 Opus 5.5로 시작합니다
v2.1.280 이전에는 플랜마다 첫 모델이 달랐습니다. Pro와 Team Standard는 Sonnet 5, Max·Team Premium·Enterprise는 Opus 5였습니다. v2.1.280은 이 차이를 없애고 모든 구독 플랜의 기본 모델을 Opus 5.5로 맞췄습니다.
- ProSonnet 5Opus 5.5
- Team StandardSonnet 5Opus 5.5
- Max·Team Premium·EnterpriseOpus 5Opus 5.5
Pro와 Team Standard에서는 모델 계열 자체가 바뀝니다. 같은 사용량 한도 안에서 더 비싼 모델이 돌기 때문에 한도에 닿는 시점이 앞당겨질 수 있습니다. 얼마나 앞당겨지는지는 문서에 나와 있지 않습니다.
직접 Max 구독 계정에서 v2.1.292의 /model을 열어 보니 첫 행이 "Default (recommended) Opus 5.5"였습니다. 여기서 고른 모델은 새 세션의 기본값으로 저장되고, s를 누르면 이번 세션에만 적용됩니다. Sonnet으로 시작하고 싶다면 이 목록에서 Sonnet 5.5를 고릅니다. 이전 모델인 Sonnet 5와 Opus 5도 목록에 남아 있습니다.
effort 설정도 하나 확인해야 합니다. /effort가 모델별 설정으로 바뀌기 전에 저장해 둔 레벨은 Opus 5.5에 적용되지 않습니다. 새 모델은 레벨을 다시 고를 때까지 자기 기본값에서 시작합니다.
opus와 sonnet 별칭이 가리키는 모델
별칭(alias)은 모델 ID 대신 쓰는 짧은 이름입니다. 설정에 opus라고 적어 두면 Claude Code가 그 버전의 최신 Opus로 연결합니다. 그래서 설정을 그대로 두어도 업데이트만으로 다른 모델이 켜집니다. 9월 마지막 주에 이 연결이 두 번 바뀌었고, 1M 창과 컴팩트 설정이 뒤따라 바뀌었습니다.
Max·Team Premium·Enterprise의 기본 모델이 Opus 5였던 때입니다. Pro·Team Standard는 Sonnet 5로 시작했습니다.
9월 23일 배포. opus 별칭이 Opus 5.5를 가리키고, 모든 구독 플랜의 기본 모델도 Opus 5.5가 됐습니다.
9월 29일 배포. Anthropic API의 sonnet이 Sonnet 5.5로 바뀌었습니다. Bedrock·Agent Platform의 sonnet은 아직 Sonnet 4.5입니다.
Bedrock·Vertex·Foundry에서도 Opus 4.7 이후 모델과 Fable이 [1m] 없이 1M 창을 씁니다.
/autocompact 값이 모델마다 저장되어, Opus와 Sonnet을 오가도 각자 컴팩트 시점이 남습니다.
단가는 두 배, 요청 한 번의 차이는 더 작습니다
v2.1.280과 v2.1.284 릴리스 노트에 단가가 적혀 있습니다. 입력과 출력은 Opus 5.5가 정확히 두 배이고, 캐시 읽기는 둘 다 100만 토큰당 $0.20입니다. 캐시 읽기는 이전 요청과 같은 앞부분을 다시 보낼 때 그 부분에 매기는 값입니다.
- $4 / $20Opus 5.5 입력 / 출력
- $2 / $10Sonnet 5.5 입력 / 출력
- $0.20캐시 읽기, 두 모델 공통
Claude Code는 턴마다 대화 전체를 다시 보냅니다. 대화가 길수록 요청의 대부분은 이미 보낸 앞부분이고, 캐시가 맞으면 그 부분은 두 모델이 같은 값을 냅니다. 500K 토큰이 쌓인 세션에서 새 입력 5K, 출력 2K인 요청 한 번을 계산해 보면 차이가 드러납니다. 캐시 쓰기 비용은 계산에서 뺐습니다.
쌓인 대화 500K까지 전부 입력 단가로 냅니다. Opus 5.5는 $2.06, Sonnet 5.5는 $1.03으로 단가 그대로 두 배입니다.
앞부분 500K가 캐시 읽기 단가 $0.20으로 바뀝니다. 두 막대가 열 배 넘게 줄어 $0.16 대 $0.13이 되고, 차이는 1.2배로 좁혀집니다.
쌓인 대화 몫 $0.10은 두 모델이 같습니다. 차이는 새 입력과 출력에서 나는 $0.03뿐입니다.
이전 모델인 Opus 5와 Sonnet 5의 단가는 확인하지 못해 비교에서 뺐습니다.
1M 창은 기본이고 줄이는 쪽이 설정입니다
컨텍스트 창은 모델이 한 번에 읽는 대화의 길이입니다. 예전에는 1M(100만 토큰) 창을 쓰려면 sonnet[1m]처럼 접미사를 붙였고, Sonnet 4.6의 1M은 Max를 포함한 모든 구독에서 사용량 크레딧이 필요했습니다. 모델 설정 문서에 따르면 Anthropic API의 Sonnet 5.5는 늘 1M 창으로 돌고 200K 변형도, [1m] 접미사도, 크레딧도 없습니다. Opus 4.7 이후 모델도 Pro를 포함한 모든 플랜에서 1M입니다.
자동 컴팩트는 창이 차기 전에 대화를 요약해 자리를 비우는 동작입니다. 직접 v2.1.292에서 Sonnet 5.5 세션을 열어 /context를 보니 창은 1m tokens였고, 자동 컴팩트 몫으로 33k 토큰이 비워져 있었습니다. 1M에서 33K를 빼면 약 967K로, 모델 설정 문서가 적은 자동 컴팩트 지점과 같습니다.
창을 줄이는 방법은 두 가지입니다. 환경 변수 CLAUDE_CODE_DISABLE_1M_CONTEXT=1은 선택기에서 1M 변형을 지우고 Sonnet 5.5 같은 모델도 200K 창으로 다룹니다. 창은 그대로 두고 컴팩트 시점만 당기려면 /autocompact 500k처럼 값을 줍니다. v2.1.288부터 이 값은 모델별로 저장되어, Opus와 Sonnet을 오가도 각자 설정이 남습니다.
# 지금 모델의 컴팩트 시점을 500K로 당기기/autocompact 500k# 모든 모델을 200K 창으로 묶기export CLAUDE_CODE_DISABLE_1M_CONTEXT=1제공자마다 별칭의 결과가 다릅니다
같은 sonnet이라도 어느 제공자로 붙느냐에 따라 다른 모델이 나옵니다. 문서의 별칭 표를 옮기면 다음과 같습니다. Bedrock과 Google Cloud의 Agent Platform에서 sonnet은 아직 Sonnet 4.5이고, Microsoft Foundry에서는 opus도 Opus 4.6입니다.
| opus | sonnet | |
|---|---|---|
| Anthropic API | Opus 5.5 | Sonnet 5.5 |
| Claude Platform on AWS | Opus 5.5 | Sonnet 4.6 |
| Bedrock·Agent Platform | Opus 5.5 | Sonnet 4.5 |
| Microsoft Foundry | Opus 4.6 | Sonnet 4.5 |
v2.1.287은 1M 기본값을 Anthropic API 밖으로 넓혔습니다. Bedrock, Vertex, Foundry, Claude apps gateway에서도 Opus 4.7 이후 모델과 Fable은 [1m] 없이 1M 창을 씁니다. 여기서도 CLAUDE_CODE_DISABLE_1M_CONTEXT=1을 주면 200K로 돌아갑니다.
이번 변경에서 비용을 가장 크게 움직이는 것은 단가표보다 기본값과 캐시입니다. 모델을 지정하지 않은 세션은 두 배 비싼 쪽에서 시작하지만, 긴 세션의 청구액은 어느 모델이냐보다 캐시가 맞느냐가 더 크게 좌우합니다. 팀 비용을 관리해야 한다면 /model로 기본 모델을 정해 두고, 창이 길어지는 것이 부담이면 /autocompact로 컴팩트 시점부터 정해 두는 편이 낫습니다. Opus 5와 Sonnet 5 시절보다 사용량 한도가 얼마나 빨리 닳는지는 아직 공개된 숫자가 없습니다.