Sonnet 5가 2026년 6월 30일 출시되자 r/ClaudeAI에는 가격표만 봐서는 설명되지 않는 불만이 곧바로 올라왔다. "고급 및 xhigh에서 같은 가격이면 Sonnet 5가 Opus보다 못한 것 아닌가?"라는 지적이었다.
한 사용자는 이유를 간단히 요약했다. Sonnet은 "토큰당으로는 실제로 더 싸지만, 작업을 끝내는 데 훨씬 많은 단계와 토큰이 들어가서 가격 우위가 사라진다."
대체로 맞는 말이다. 단, 예외는 있다. 같은 예산으로 Claude Opus 5와 Sonnet 5를 비교하면 거의 모든 구간에서 Opus가 유리하다. 작업당 약 $2.30을 넘기면, Opus를 Sonnet보다 한 단계 낮은 노력 티어로 설정해도 비용과 품질 모두에서 Sonnet의 한 단계 높은 티어를 앞선다. 반대로 그 아래 구간과 짧은 단발성 작업에서는 Sonnet 5가 3.4배 저렴하다.
Opus 5와 Sonnet 5, 각각 잘하는 일
| Claude Opus 5 | Claude Sonnet 5 | |
|---|---|---|
| 모델 ID | claude-opus-5 | claude-sonnet-5 |
| 출시일 | 2026년 7월 24일 | 2026년 6월 30일 |
| 입력 / 출력 MTok당 가격 | $5 / $25 | 2026년 8월 31일까지 $2 / $10, 이후 $3 / $15 |
| 배치 입력 / 출력 | $2.50 / $12.50 | 2026년 8월 31일까지 $1 / $5 |
| 노력 티어 | low, medium, high, xhigh, max(기본값 high) | 동일한 5개 티어(기본값 high) |
| 확장 사고 | 기본 활성화 | 적응형 |
| 컨텍스트 / 최대 출력 | 1M / 128k 토큰 | 1M / 128k 토큰 |
| 지식 컷오프 | 2026년 5월 | 2026년 1월 |
| 토큰당 할인 | 없음 | 현재 Opus 대비 60% 할인, 9월 1일부터 40% 할인 |
| 가장 적합한 용도 | 장기 에이전트 실행, 어려운 추론, 검토 비용이 큰 작업 | 단발성 추출, 높은 동시성, 지연 시간에 민감한 UX |
| 자체 4개 작업 스모크 테스트 | 4/4 통과, 출력 1,182토큰, 2.955¢ | 4/4 통과, 출력 858토큰, 0.858¢ |
아직 Opus 5를 대상으로 한 공개 장기 에이전트 벤치마크는 없다. 따라서 아래 작업당 비용 표의 Opus 열에는 Opus 4.8 데이터를 넣었다. 이는 보수적인 하한선으로 봐야 한다. 두 모델의 가격은 같고, Anthropic은 에이전트 작업에서 Opus 5가 4.8보다 앞선다고 설명한다.
같은 예산에서 Claude Opus 5와 Sonnet 5를 비교할 수 있는 이유는 단순하다. 두 모델 모두 베타 헤더 없이 같은 다섯 가지 티어에서 동일한 effort 파라미터를 사용한다. 즉 모델을 바꾸는 대신 다이얼을 조절해 성능을 구매하는 구조다. 가격은 Claude Platform 가격 페이지를 기준으로 했으며, 2026년 7월 25일 확인했다.
티어별 비용 역전 지점
티어별 수치는 Datacurve의 장기 에이전트 리더보드 DeepSWE v1.1에서 가져왔다.
- 병합된 PR에서 가져오지 않고 처음부터 작성한 113개 작업으로, 오염 없는 벤치마크라는 주장에 근거가 된다
- 91개 리포지터리, 5개 언어
- 모든 모델에 공통 하네스를 적용하고 작업당 4회 실행
- 마지막 업데이트는 7월 21일로, Opus 5 출시 3일 전이다
따라서 Opus 열에는 Opus 4.8이 들어가며, 남은 변수는 Opus 5가 작업당 Opus 4.8보다 더 많은 토큰을 쓰는지 여부다.
| 노력 수준 | Sonnet 5 작업당 $ | Opus 4.8 작업당 $ | Sonnet ÷ Opus | Sonnet pass@1 | Opus pass@1 |
|---|---|---|---|---|---|
| low | $2.19 | $2.29 | 0.95x | 30.5% | 40.8% |
| medium | $4.08 | $3.44 | 1.18x | 39.8% | 48.7% |
| high | $7.43 | $4.28 | 1.73x | 48.2% | 51.8% |
| xhigh | $11.89 | $8.01 | 1.49x | 49.7% | 54.4% |
| max | $26.40 | $13.22 | 2.00x | 53.8% | 59.0% |
Sonnet 5가 더 싼 티어는 low 하나뿐이다. 그리고 이 구간에서는 pass rate를 10.3포인트 내준다.
토큰당 저렴한데도 청구액이 커지는 이유
답은 장황함이 아니라 단계 수다.
| 노력 수준 | Sonnet 5 중앙 단계 수 | Opus 4.8 중앙 단계 수 | Sonnet 작업당 입력량 | Opus 작업당 입력량 |
|---|---|---|---|---|
| low | 70 | 47 | 4.5M | 2.4M |
| max | 260 | 116 | 72.4M | 17.0M |
읽는 텍스트가 네 배가 되면 토큰당 60% 할인으로는 버티기 어렵다.
달러 기준 수치를 신뢰할 수 있는 이유
먼저 주의할 점이 하나 있다. DeepSWE는 가격 산정 기준을 공개하지 않는다.
7월 13일 진행된 별도의 24개 작업 실행은 Claude Code에서 두 모델의 다섯 티어를 모두 다뤘다. DeepSWE의 Sonnet 열에 표준 $3/$15 대비 프로모션 $2/$10 비율인 0.67을 적용하면, 모든 티어에서 두 결과는 0.03 이내로 일치한다.
서로 독립적인 두 작업 세트가 medium과 high 사이의 동일한 지점에서 비용 역전을 보였다. 이 일치는 DeepSWE가 Sonnet에 표준 요금을 적용했음을 뒷받침하는 근거이기도 하다.
해당 작성자는 그 글에서 연결한 하네스인 Stet을 개발하고 판매한다. 따라서 판매자가 직접 수행한 테스트라는 점은 감안해야 한다.
같은 예산이라면 티어를 다르게 봐야 한다
같은 티어끼리 비교한 표는 사실 질문을 잘못 잡고 있다. 사용자가 사는 것은 노력 티어가 아니라 특정 비용에서 얻는 결과다. Claude Opus 5와 Sonnet 5를 비용 기준으로 놓으면 비교 순서가 달라진다.
아래 표는 각 Sonnet 5 설정에 대해, 같은 pass rate 이상을 낼 수 있는 가장 저렴한 Opus 4.8 티어를 찾은 것이다. 프로모션 열은 표준 요금 수치에 0.67을 곱한 추정값이다.
| Sonnet 5 설정 | Sonnet pass@1 | Sonnet $, 표준 | Sonnet $, 프로모션(추정) | 이를 따라잡는 최저 Opus 4.8 티어 | Opus $ | Opus pass@1 | 프로모션 Sonnet 대비 Opus 비용 | 품질 차이 |
|---|---|---|---|---|---|---|---|---|
| low | 30.5% | $2.19 | $1.47 | low | $2.29 | 40.8% | 1.56x | +10.3pp |
| medium | 39.8% | $4.08 | $2.73 | low | $2.29 | 40.8% | 0.84x | +1.0pp |
| high | 48.2% | $7.43 | $4.98 | medium | $3.44 | 48.7% | 0.69x | +0.4pp |
| xhigh | 49.7% | $11.89 | $7.97 | high | $4.28 | 51.8% | 0.54x | +2.1pp |
| max | 53.8% | $26.40 | $17.69 | xhigh | $8.01 | 54.4% | 0.45x | +0.5pp |
마지막 두 열을 위에서 아래로 읽어보면 된다. 고려 중인 Sonnet 티어보다 Opus를 한 단계 낮추면, 프로모션 가격과 비교해도 같은 수준 또는 더 높은 pass rate를 16%~55% 낮은 비용으로 얻는다. 예외는 맨 아래 low 구간이다. low effort의 프로모션 Sonnet 5는 36% 저렴하지만, pass rate 10.3포인트를 포기해야 한다.
반대로 해석할 수도 있다
첫 번째 스레드의 한 댓글 작성자는 medium effort 공식 차트를 다르게 읽었다. 성공률이 68%와 62%일 때 Opus는 약 $7, Sonnet은 $4.50이므로, "이 테스트에서 성공률이 10%도 안 오르는데 가격은 55% 증가한다"는 해석이다.
실패한 결과가 아무 비용도 발생시키지 않는 작업이라면 합리적인 선택이다. 하지만 잘못된 diff가 프로덕션에 들어갈 수 있다면 이야기가 달라진다.
어느 해석이든 결국 다른 사람의 작업 분포에 기대고 있다. 토큰당 비용이 아니라 성공 완료 1건당 비용으로 채점한 자체 작업 20~50개가 이 글의 어떤 표보다 낫다.
같은 $5와 $25에서 Opus 5가 바꾸는 변수
Opus 5 출시 가격은 Opus 4.8과 항목별로 완전히 같다. 그래서 남은 세 번째 축은 작업당 토큰 수다. 현재 근거는 양쪽 가능성을 모두 가리킨다.
| Opus 5의 작업당 비용이 더 낮을 수 있는 근거 | 더 높을 수 있는 근거 |
|---|---|
| Anthropic은 Opus 5가 Frontier-Bench v0.1에서 1위를 차지했으며, "더 낮은 작업당 비용으로 Opus 4.8 성능의 두 배 이상"이라고 발표했다(벤더 자체 실행 결과이며, 독립 재현은 없다) | Opus 4.8에서는 꺼져 있던 확장 사고가 기본 활성화되어 있다 |
| 익명의 법률 파트너가 max reasoning에서 토큰을 약 26% 적게 사용했다고 한다(Anthropic 전달 내용이며 방법론은 공개되지 않았다) | 자체 4개 작업에서 Opus 4.8은 출력 380토큰, Opus 5는 1,182토큰을 사용했다 |
어느 방향으로 갈지 아직 확정되지 않았다. 예산을 확정하기 전에 자체 리포지터리에서 비용 열을 다시 측정해야 한다.
Opus 5 비용을 줄이려는 사람이 빠지기 쉬운 함정도 있다. thinking: {"type": "disabled"}는 high 이하 노력 수준에서만 허용되며 xhigh 또는 max에서는 400을 반환한다. 마이그레이션 전에는 Opus 4.8과 Opus 5 사이의 여러 호환성 변경 사항도 확인할 가치가 있다.
Sonnet 5가 이기는 영역: 짧은 단발성 작업
2026년 7월 24일 두 모델에 작은 작업 네 개를 실행했고, 주관적 판단이 아닌 스크립트로 채점했다. kth_smallest의 결함 두 개 수정, 고정된 키 순서와 자체 일관적인 체크섬을 갖춘 엄격한 JSON 출력, 답이 65인 Frobenius-number 문제, 시그니처는 유지하면서 검증을 추가하고 주석은 하나도 남기지 않는 리팩터링이다.
두 모델 모두 네 작업을 전부 통과했다. 차이는 사용량 측정기에서 드러났다.
| Claude Sonnet 5 | Claude Opus 5 | |
|---|---|---|
| 통과한 검사 | 4/4 | 4/4 |
| 4개 작업 출력 토큰 | 858 | 1,182 |
| 총 지연 시간 | 13.7s | 24.6s |
| 프로모션 / 표준 요금 기준 출력 비용 | 0.858¢ / 1.287¢ | 2.955¢ |
검증된 출력은 같았지만, 현재 Sonnet 가격 기준 Opus 5의 비용은 3.4배였고 프로모션 종료 후에도 2.3배다. Sonnet은 실제 경과 시간도 절반을 약간 넘는 수준이었다. Claude Code의 퍼스트파티 채널에서 코딩 작업 두 개를 반복했을 때도 방향은 같았다. Sonnet 5는 출력 240토큰, Opus 5는 465토큰이었다.
다만 이 수치보다 더 중요한 한계가 세 가지 있다.
- 작업별 모델당 1회만 실행했다. 벤치마크가 아니라 스모크 테스트다.
- 게이트웨이가 가변적인 시스템 프롬프트를 주입해 입력 토큰 수를 청구 계산에 쓸 수 없었으므로, 공식 출력 요금만 적용한 출력 토큰 비용이다.
- 짧은 프롬프트 네 개만 다뤘다. 이는 커뮤니티 논쟁에서 제외되는 바로 그 영역이다. 70단계짜리 작업은 하나도 없으므로 단계 수 폭증도 재현하지 않는다.
이 경계 안에서는 Sonnet 5의 할인이 그대로 유지된다. 한 개발자는 정확히 이런 형태의 작업을 문서 중심 에이전트의 "추론이 거의 필요 없는 단발성 추출"이라고 설명하며, 이 경우 "Opus는 과하다"고 말했다.
이 글의 모든 수치에 붙는 두 날짜
2026년 6월 30일: 공식 비용 차트가 수정됐다
Anthropic의 Claude Sonnet 5 발표문에는 변경 이력 메모가 있다. 최초 비용 대비 성능 차트는 "에이전트 검색 평가에 사용하는 표준 방법론을 반영하지 못한 더 단순한 방법론"을 사용했고, 그 결과 "평가에서 Sonnet 5 성능을 과소평가했다"고 적혀 있다.
차트와 주변 설명은 시스템 카드의 BrowseComp 방법론에 맞게 수정됐다. 이 방법론은 "압축과 프로그래밍 방식 도구 호출을 사용한 10M 토큰 예산"을 사용했다.
따라서 해당 차트를 인용한다면 어느 수정본인지 확인하고 캡션을 읽어야 한다. Sonnet 5는 표준 $3/$15로 계산했고, 프로모션 가격을 적용한 실제 비용은 차트보다 낮다고 명시한다. Opus 4.8은 $5/$25로 계산한다.
2026년 9월 1일: 프로모션 가격이 끝난다
Sonnet 5의 출시 프로모션 요금은 만료되고, 공개된 모든 가격 항목은 50% 오른다. Opus 5는 $5/$25를 유지한다. 발행일 기준으로 37일의 유예 기간만 남아 있으며, 그 뒤에는 현재 요금으로 설계한 모든 지출 모델이 틀리게 된다.
이 논쟁에서는 적용되지 않는데도 자주 언급되는 날짜가 하나 더 있다. Claude 4.7 토크나이저는 Sonnet 4.6보다 동일한 텍스트에서 토큰을 약 30% 더 생성한다. 따라서 토큰당 Sonnet 5 가격을 Sonnet 4.6과 비교하면 실제 인상 폭을 과소평가하게 된다. 다만 Opus 5와 Sonnet 5는 같은 토크나이저를 쓰므로, 두 모델 사이에서는 이 비용이 상쇄된다.
예산별 추천 모델
Claude Opus 5와 Sonnet 5의 선택은 하나의 승자가 아니라 세 가지 라우팅 규칙으로 정리된다. 기준선은 Opus 자리에 Opus 4.8을 넣은 DeepSWE의 평균 작업당 비용이다. 따라서 리포지터리 작업을 위한 출발 구간일 뿐, 리서치 에이전트·지원 파이프라인·문서 워크플로에 그대로 적용되는 상수는 아니다.
- 작업당 약 $2.30 미만이라면 low effort의 Sonnet 5를 선택한다. 에이전트 작업에서도 가격 우위가 유지되는 유일한 구성이다. 다만 pass rate는 30.5%다. 단발성 추출, 분류, 출력 범위가 정해진 작업이라면 이 구간에 머물면서 자체 테스트에서 확인한 3.4배 절감 효과를 가져가면 된다. 한 개발자는 Sonnet 5가 "작업의 90%에서는 Opus에 충분히 가깝지만, 상대적으로 즉각적"이라고 표현했다. 사람이 기다리는 상황에서는 이 차이가 중요하다.
- 작업당 약 $2.30~$8에서는 Sonnet을 한 단계 올리기보다 Opus를 한 단계 낮춰 선택한다. 실무 기본값은 Opus medium, 리뷰에서 실수를 잡아내는 비용이 큰 경우에는 Opus high가 적합하다. Opus 5는 토큰당 가격은 같지만 작업당 토큰 수가 아직 측정되지 않았으므로, 이 구간은 테스트를 시작할 지점으로 봐야 한다.
- $8 이상이라면 Sonnet 다이얼을 더 올리지 않는다. DeepSWE에서 Sonnet 5 max는 작업당 $26.40에 53.8%였고, Opus 4.8 xhigh는 $8.01에 54.4%였다. Fable 5는 low effort에서 $3.76로 59.6%에 도달했다. AIReiter는 Opus 4.8을 MTok당 $1.56/$7.76으로 제공하며, 이는 정가보다 약 69% 낮다. 다만 아직 Claude 라인업에 Opus 5는 없다.
FAQ
Claude Opus 5는 Sonnet 5보다 비싼가?
토큰당으로는 그렇다. Sonnet 5의 프로모션 $2/$10과 비교하면 Opus 5는 $5/$25로, 2026년 8월 31일까지는 2.5배, 이후에는 1.67배다. 하지만 완성된 작업당 비용은 순서가 뒤집힐 수 있으며, 일부 극단적인 실행 사례 때문만도 아니다. DeepSWE의 max effort 중앙 비용은 Sonnet 5가 $23.28, Opus 4.8이 $12.35였다.
Claude Sonnet 5 가격은 얼마인가?
2026년 8월 31일까지 입력 100만 토큰당 $2, 출력 100만 토큰당 $10이다. 9월 1일부터는 각각 $3와 $15가 된다. 공개된 모든 가격 항목에서 50% 오르는 구조다. 5분 캐시 쓰기는 $2.50에서 $3.75, 1시간 캐시 쓰기는 $4에서 $6, 캐시 히트는 $0.20에서 $0.30으로 오른다. 프로모션 기간 배치 가격은 $1/$5다.
더 저렴한 모델이 왜 결국 더 비싸지는가?
청구액은 작업 수가 아니라 단계 수에 따라 커지기 때문이다. 노력 다이얼 전반에서 Sonnet 5의 중앙 단계 수는 70에서 260으로 늘어나는 반면, Opus 4.8은 47에서 116이다. max에서 Sonnet의 작업당 입력량은 72.4M 토큰으로 Opus의 17.0M에 달한다. 읽는 양이 네 배가 되면 토큰별 60% 할인도 무력해진다.
Opus 5는 Sonnet 5보다 훨씬 뛰어난가?
단일 시도 기준으로는 그렇다. DeepSWE에서 Opus 4.8은 Sonnet 5보다 pass@1에서 3.5~10.3포인트 앞섰고, 차이는 low 구간에서 가장 컸다.
각각 네 번 시도하게 하면 격차는 거의 사라진다. high effort의 Sonnet 5는 pass@4 79.6%로 Opus 4.8의 77.9%를 앞섰고, max에서는 각각 78.8%와 79.3%였다. Sonnet도 도달할 수는 있지만 더 많은 시도가 필요하고, 매 시도마다 비용을 낸다.
Sonnet 5의 9월 1일 가격 인상은 결론을 바꾸는가?
비용 역전 지점을 위가 아니라 아래로 내린다. Sonnet 5의 토큰당 우위는 60%에서 40%로 줄어드는 반면 Opus 5는 $5/$25를 유지한다. 따라서 예산 기준 비교표의 모든 조합은 Sonnet에 더 불리해진다. 프로모션 가격에서 Opus low보다 36% 저렴했던 Sonnet low라는 유일한 유리한 행도, 표준 요금에서는 약 4% 저렴한 수준으로 줄어든다.
