Claude Sonnet 5.5의 새로운 기능 및 변경점
Anthropic은 Sonnet 5의 직접적인 업그레이드 버전으로 2026년 9월 28일 Claude Sonnet 5.5를 출시했습니다. 정가는 변동이 없지만, 수행할 수 있는 작업 역량과 소모되는 토큰 수는 크게 달라졌습니다.
지식 작업에서 Opus 5.5에 근접한 성능
Anthropic 발표에 따르면 Sonnet 5.5의 GDPval-AA 점수는 1844점으로, Opus 5.5(1846점)에 단 2점 뒤처지며 Sonnet 5(1449점)보다 약 400점 앞섭니다. 또한 Anthropic은 지속적인 판단력이 필요한 개방형 작업에서는 여전히 Opus 5.5가 확연히 우세하다고 밝혔습니다.
코딩 역량의 비약적인 향상
CursorBench 4.0에서 Anthropic은 Sonnet 5.5의 점수를 55.5%로 발표했으며, 이는 Sonnet 5의 34.1%, Opus 5.5의 57.8%와 비교됩니다. Anthropic은 이 모델을 기능 구축, 버그 수정, 문서·슬라이드·스프레드시트 작성 등 범위가 명확한 일상적인 업무에 적합한 모델로 포지셔닝하고 있습니다.
동일한 작업에 더 적은 토큰 소모
초기 고객들은 실제 워크로드에서의 비용 절감 효과를 보고했습니다. Slack은 프롬프트를 변경하지 않고도 출력 토큰이 약 14% 감소했으며, Balyasny Asset Management는 2,441개의 금융 업무에서 답변당 토큰 수가 Sonnet 5의 497K에서 약 121K로 줄어들었다고 측정했습니다.
동일한 토크나이저로 더 빠른 출력
Anthropic에 따르면 출력이 Sonnet 5보다 30% 이상 빠르며, Artificial Analysis는 초당 약 139개의 출력 토큰을 측정했습니다. 토크나이저는 변경되지 않았으므로 동일한 텍스트는 두 모델 모두에서 동일한 토큰 수로 계산됩니다.
Claude Sonnet 5.5 vs Sonnet 5 vs Opus 5.5
세 모델 모두 동일한 AIReiter 키에서 실행됩니다. 요약하자면, 아래의 마이그레이션 확인 사항을 통과하면 Sonnet 5에서 전환하고, 가장 난이도가 높은 개방형 작업에는 Opus 5.5를 유지하세요.
Sonnet 5.5 vs Sonnet 5: 동일한 가격, 더 뛰어난 작업 처리
두 모델 모두 정가는 100만 토큰당 입력 $2, 출력 $10입니다. Sonnet 5.5는 위의 코딩 및 지식 작업 벤치마크에서 더 높은 점수를 기록하고 보통 더 적은 토큰으로 완료하므로, 동일한 작업에 드는 비용이 더 저렴해집니다.
Sonnet 5.5 vs Opus 5.5: 절반 가격
여기서 Sonnet 5.5는 100만 토큰당 입력 $1.00, 출력 $5.00이며, Opus 5.5는 $2.00 및 $10.00입니다. 두 모델 모두 1M 토큰 컨텍스트 윈도우와 128K 최대 출력을 지원하므로, 전환 시 model 필드만 변경하면 됩니다.
여전히 Opus 5.5를 사용할 만한 경우
모델이 계획을 수립하고, 실수를 스스로 인지하며 계속 진행해야 하는 길고 모호한 작업이 해당됩니다. Base44는 앱 빌드당 반복 횟수가 Opus 5의 7.7회 대비 Sonnet 5.5에서는 3.6회였다고 보고했으므로, 먼저 Sonnet 5.5를 시도한 뒤 실패하는 작업에만 상위 모델을 적용해 보세요.
당분간 Sonnet 5를 유지해야 하는 경우
코드에서 thinking을 비활성화하거나, 특정 도구를 강제 지정하거나, temperature를 설정하는 경우, 해당 설정을 변경할 때까지 Sonnet 5.5에서 요청이 실패합니다. 보안 도구에서도 거부(refusal) 응답이 더 많이 발생할 수 있습니다. 이를 먼저 수정한 후 전환하세요.
Sonnet 5에서 마이그레이션: 이제 오류를 반환하는 항목
모델 문자열을 claude-sonnet-5-5로 변경하는 것만으로는 충분하지 않을 수 있습니다. 다음 요청 형태는 Sonnet 5에서는 작동했지만 Sonnet 5.5에서는 거부됩니다.
thinking: disabled 사용 시 400 에러 반환
Adaptive thinking(적응형 사고)은 항상 활성화되어 있습니다. {"type": "disabled"}를 첫 응답 전 사고를 건너뛰는 최저 설정인 {"type": "between_tools"}로 대체하세요. between_tools는 low, medium, high effort에서만 작동하며, xhigh 또는 max의 경우 thinking을 생략하거나 {"type": "adaptive"}를 전송하세요.
수동 thinking budget 설정 시 400 에러 반환
thinking: {"type": "enabled", "budget_tokens": N} 설정은 거부됩니다. 대신 effort 수준으로 깊이를 제어하세요. Thinking 토큰은 여전히 max_tokens에서 차감되며 출력으로 청구되므로, 답변이 잘리기 시작하면 max_tokens를 늘리세요.
특정 도구 강제 선택 시 오류 반환
하나의 특정 도구를 강제 지정하는 tool_choice는 이제 오류를 반환합니다. 엄격한 도구 정의와 함께 자동 도구 선택(automatic tool choice)을 사용하고, 호출 시점은 모델이 결정하도록 하세요.
사용자 지정 temperature, top_p, top_k 사용 시 400 에러 반환
기본 샘플링만 허용됩니다. 해당 필드에 고정값을 설정하지 말고 요청에서 제거하세요. 반가운 변화도 있습니다. 캐시 가능한 최소 프롬프트 크기가 1,024 토큰에서 512 토큰으로 줄어듭니다.
배포하기 전에 effort 수준을 선택하세요
Effort는 이제 비용과 지연 시간을 조절하는 주요 다이얼입니다. low, medium, high, xhigh, max의 5가지 수준이 있습니다.
API 기본값은 high입니다
effort를 전달하지 않으면 API는 high로 실행됩니다. Claude Code 및 Claude 앱의 기본값은 medium입니다. 청구 금액이 기본값에 영향을 받지 않도록 output_config.effort를 명시적으로 설정하세요.
max는 비용이 많이 듭니다
max effort에서 Artificial Analysis는 정가 기준 태스크당 $7.60, 인덱스 전체에서 중앙값 88M 대비 410M 출력 토큰을 측정했습니다. Anthropic의 효율성 주장은 max가 아닌 더 낮은 수준에 해당합니다.
medium으로 시작하여 측정한 후 조정하세요
실제 작업을 medium으로 실행하고 품질을 확인한 후 부족한 부분에서만 단계를 높이세요. 지연 시간에 민감한 도구 루프의 경우 low 또는 between_tools thinking이 포함된 medium을 사용하면 초기 응답을 빠르게 유지할 수 있습니다.
AIReiter의 Claude Sonnet 5.5 API 가격
모든 항목이 Anthropic 정가의 50%로 청구됩니다. 동일한 모델, 동일한 Messages 프로토콜을 사용합니다.
모든 항목에서 정가의 절반
입력 $1.00 (정가 $2.00). 출력 $5.00 (정가 $10.00). 캐시 읽기 $0.10 (정가 $0.20). 캐시 쓰기 $1.25 (정가 $2.50). 모두 100만 토큰당 기준입니다.
실제 호출 예시: $3.00 대신 $1.50
입력 토큰 100만 개와 출력 토큰 10만 개는 당사에서 $1.50, Anthropic 정가로는 $3.00입니다. 당사에서 Opus 5.5로 동일하게 호출하면 $3.00입니다.
실제 사용된 토큰에 대해서만 청구
호출이 시작될 때 예상 금액이 보류된 후, 응답이 완료되면 실제 토큰 수에 따라 정산되고 차액이 반환됩니다. 첫 번째 토큰부터 100만 번째 토큰까지 요율은 동일하며 별도의 긴 컨텍스트 요금제 구간은 없습니다.
Claude Sonnet 5.5 API 호출 방법
엔드포인트가 Anthropic Messages 프로토콜을 지원하므로, 기존 Claude 클라이언트는 새 base URL과 키만 있으면 됩니다.
키를 발급받고 클라이언트가 AIReiter를 가리키도록 설정하세요
AIReiter 대시보드에서 API 키를 생성하세요. 공식 Anthropic SDK에서 기본 URL을 https://aireiter.com/api 로 설정하면 SDK가 자동으로 /v1/messages 를 추가합니다.
curl로 요청 보내기
curl https://aireiter.com/api/v1/messages \ -H "x-api-key: $AIREITER_API_KEY" \ -H "anthropic-version: 2023-06-01" \ -H "content-type: application/json" \ -d '{ "model": "claude-sonnet-5-5", "max_tokens": 4096, "output_config": {"effort": "medium"}, "messages": [{"role": "user", "content": "Hello"}] }'
또는 Python SDK 사용
from anthropic import Anthropic client = Anthropic(api_key="YOUR_AIREITER_KEY", base_url="https://aireiter.com/api") msg = client.messages.create( model="claude-sonnet-5-5", max_tokens=4096, messages=[{"role": "user", "content": "Hello"}], ) print(msg.content[0].text)
Claude Sonnet 5.5 API FAQ
/ 01Claude Sonnet 5.5는 언제 출시되었으며 모델 ID는 무엇인가요?
Anthropic은 2026년 9월 28일에 이를 출시했습니다. API 모델 ID는 claude-sonnet-5-5이며, 지식 마감일은 2026년 6월입니다.
/ 02컨텍스트 윈도우와 최대 출력은 어떻게 되나요?
1M 토큰 컨텍스트 윈도우와 요청당 최대 128K 출력 토큰을 지원합니다. 텍스트 및 이미지 입력을 허용하고 텍스트를 반환합니다.
/ 03Claude Sonnet 5.5 API 비용은 얼마인가요?
Anthropic의 정가는 Sonnet 5와 동일하게 100만 토큰당 입력 $2, 출력 $10입니다. AIReiter는 그 절반 가격인 입력 $1, 출력 $5, 캐시 읽기 $0.10, 캐시 쓰기 $1.25를 청구합니다.
/ 04생각하기(thinking) 기능을 끌 수 있나요?
완전히 비활성화할 수는 없습니다. thinking disabled는 400 오류를 반환합니다. 가장 낮은 설정은 between_tools이며, low, medium, high effort에서 작동합니다.
/ 05Sonnet 5.5가 Sonnet 5보다 더 나은가요?
Anthropic이 발표한 코딩 및 지식 작업 벤치마크에 따르면 동일한 정가에서 훨씬 더 뛰어납니다. 일부 Sonnet 5 요청 형식은 이제 실패할 수 있으므로 전환하기 전에 위의 마이그레이션 변경 사항을 확인하세요.
/ 06보안 관련 질문이 거부되었거나 Sonnet 5가 응답한 이유는 무엇인가요?
Sonnet 5.5는 Anthropic의 최고 성능 모델에 사용되는 사이버 보안 보호 조치가 적용된 최초의 Sonnet입니다. 위험도가 높은 일부 요청은 Sonnet 5로 폴백되며, 유해하지 않은 보안 작업에서도 거부가 더 자주 발생할 수 있습니다. 이는 업스트림 동작 방식입니다.
/ 07Anthropic 계정이 필요한가요?
아닙니다. AIReiter 키는 AIReiter 엔드포인트에서 작동하며, 코드를 작성하기 전에 이 페이지의 플레이그라운드에서 모델을 테스트해 볼 수 있습니다.
/ 08어떤 API가 지원되나요?
/api/v1/messages의 Anthropic Messages가 스트리밍을 지원하는 기본 규격입니다. OpenAI 스타일의 Chat Completions 및 Responses API도 제공되며, /api/v1/models는 보유한 키로 사용할 수 있는 모델 목록을 반환합니다.