AIREITER
AnthropicText Chat

Claude Haiku 5.5

Anthropic 정가의 절반으로 이용하는 Claude Haiku 5.5 API: 100K 입력까지 1M 토큰당 입력 $0.05, 출력 $0.25. 롱 컨텍스트 티어, Haiku 4.5 대비 주요 변경 사항, 작동하는 코드 제공.

입력 Token입력출력캐시 읽기캐시 생성
≤ 100,000$0.05 100만 토큰당$0.25 100만 토큰당$0.005 100만 토큰당$0.0625 100만 토큰당
> 100,000$0.25 100만 토큰당$1.25 100만 토큰당$0.025 100만 토큰당$0.3125 100만 토큰당

요금은 백만 토큰 기준입니다. 캐시 읽기와 쓰기를 포함한 총 입력 토큰 수에 따라 전체 요청에 해당 요금 구간이 적용됩니다.

API로 실행

입력

출력

Example
Generated in
42.7 seconds
입력 Token
134
출력 Token
2354
Tokens per second
55.13 tokens / second
Time to first token
-

모델 세부정보

플레이그라운드, API 요청, 내부 워크플로에서 동일한 모델 키를 사용하세요.

모델 ID
claude-haiku-5-5
공급자
Anthropic
프로토콜
Anthropic Messages
컨텍스트 창
1,000,000 토큰
최대 출력
128,000 토큰

Claude Haiku 5.5의 새로운 기능

Anthropic은 Haiku 4.5 출시 1년 후인 2026년 10월 7일에 Claude Haiku 5.5를 출시했습니다. 짧은 프롬프트 기준 가격이 90% 인하되었으며, 성능은 Sonnet에 훨씬 더 가까워졌습니다.

effort 제어를 지원하는 최초의 Haiku

Haiku 5.5는 적응형 사고(adaptive thinking)와 5단계 effort 수준(low, medium, high, xhigh, max)을 사용합니다. 기본값은 medium입니다. 이전 Haiku 모델에는 effort 설정이 없었습니다.

1M 컨텍스트 및 128K 출력

컨텍스트 윈도우가 Haiku 4.5의 200K 토큰에서 1M으로 확장되었으며, 최대 출력은 64K에서 128K로 늘어났습니다. 텍스트와 이미지 입력을 지원합니다. 지식 컷오프는 2026년 6월입니다.

에이전트 및 사무 작업 성능의 대폭 향상

Anthropic에 따르면 max effort 기준 OSWorld 2.1에서 72.4%(Haiku 4.5: 15.7%), GDPval-AA Elo 1620점(Haiku 4.5: 735점)을 기록했습니다. 단, Anthropic이 발표한 모든 벤치마크에서 Sonnet 5.5가 여전히 앞서고 있습니다.

독립 벤치마크 점수

Artificial Analysis의 Intelligence Index에서 Haiku 5.5는 max effort 기준 43점(Haiku 4.5는 17점), 기본 medium effort 기준 34점을 기록했습니다.

Claude Haiku 5.5 vs Haiku 4.5 vs Sonnet 5.5

이 모든 모델은 동일한 AIReiter 키에서 실행되므로, model 필드만 변경하여 손쉽게 전환할 수 있습니다.

Haiku 5.5 vs Haiku 4.5

Haiku 4.5의 정가는 100만 토큰당 입력 $1, 출력 $5입니다. Haiku 5.5는 100K 토큰 이하 프롬프트 기준 정가 $0.10 및 $0.50입니다. 동일한 텍스트에 대해 약 30% 더 많은 토큰을 생성하는 최신 토크나이저를 감안하더라도, Anthropic은 실제 워크로드 비용이 약 75% 절감될 것으로 추정합니다.

Haiku 5.5 vs Sonnet 5.5

이곳에서 Sonnet 5.5는 100만 토큰당 입력 $1.00, 출력 $5.00으로 Haiku 5.5 기본 요금의 20배입니다. Anthropic은 복잡한 코딩 작업에는 여전히 Sonnet 5.5 또는 Opus 5.5를 권장합니다. 분류, 데이터 추출, 요약, 라우팅 및 서브에이전트 단계 작업에는 Haiku 5.5를 사용하세요.

Haiku 5.5 vs GPT-6 Luna

두 모델 모두 정가 기준 입력 $0.10, 출력 $0.50입니다. Anthropic에 따르면 Haiku 5.5가 OSWorld 2.1(72.4% vs 48.9%) 및 GDPval-AA(1620 vs 1437)에서 앞서고 있습니다. 단, Artificial Analysis는 Haiku 5.5가 유사한 점수에 도달하기 위해 Luna보다 더 많은 출력 토큰을 사용한다고 지적하므로, 실제 작업에서 직접 비교해 보시기 바랍니다.

AIReiter의 Claude Haiku 5.5 API 요금

모든 항목은 Anthropic 정가의 50%로 청구됩니다. 요율은 단일 요청이 전송하는 입력 토큰 수에 따라 결정됩니다.

최대 100K 입력 토큰

입력 $0.05 (정가 $0.10). 출력 $0.25 (정가 $0.50). 캐시 읽기 $0.005 (정가 $0.01). 캐시 쓰기 $0.0625 (정가 $0.125). 모두 100만 토큰당 기준입니다.

100K 입력 토큰 초과: 모든 요율 5배

입력 $0.25 (정가 $0.50). 출력 $1.25 (정가 $2.50). 캐시 읽기 $0.025 (정가 $0.05). 캐시 쓰기 $0.3125 (정가 $0.625). 티어는 캐시된 토큰을 포함한 총 입력량을 기준으로 요청별로 결정되며, 요청 전체에 적용됩니다.

실제 호출 예시 2가지

50K 입력 및 5K 출력 시 이곳에서는 $0.00375가 청구됩니다 (정가 $0.0075). 200K 입력 및 10K 출력은 롱 컨텍스트 티어에 해당하여 $0.0625가 청구됩니다 (정가 $0.125). 긴 작업을 100K 미만의 요청으로 분할할 수 있다면 비용이 5분의 1로 줄어듭니다.

실제 사용된 토큰에 대해서만 청구

호출 시작 시 예상 금액이 보류되고 응답 완료 시 실제 토큰 수에 따라 정산되어 차액이 반환됩니다. Thinking 토큰은 출력으로 청구됩니다.

Haiku 4.5에서 마이그레이션: 이제 오류를 반환하는 항목

모델 문자열을 claude-haiku-5-5로 변경하는 것만으로는 충분하지 않을 수 있습니다. 다음 요청 형식은 Haiku 4.5에서는 작동했지만 Haiku 5.5에서는 거부됩니다.

temperature, top_p 및 top_k 제거

기본값이 아닌 샘플링 값은 "deprecated for this model" 오류와 함께 400을 반환합니다. 해당 필드를 제거하고 프롬프트 및 effort 수준으로 출력을 조절하세요.

어시스턴트 prefill 미지원

어시스턴트 메시지로 끝나는 대화는 400을 반환합니다. 마지막 메시지는 반드시 사용자가 보낸 것이어야 합니다. 형식을 강제하려면 structured outputs를 사용하거나 프롬프트에 명시하세요.

thinking budgets를 effort로 대체

Anthropic의 API는 이 모델에서 thinking: {"type": "enabled", "budget_tokens": N}을 거부하므로 이를 제거하고 대신 output_config.effort를 설정하세요. Thinking 토큰은 여전히 max_tokens에서 차감되므로 답변이 잘리면 max_tokens를 늘리세요.

thinking을 비활성화하면 effort가 high로 제한됨

thinking: {"type": "disabled"}는 low, medium, high effort에서 작동합니다. xhigh 또는 max의 경우 400을 반환합니다. Sonnet 5.5에서 사용되는 between_tools thinking 모드는 Haiku 5.5에서 지원되지 않습니다. 강제 tool_choice는 여전히 작동합니다.

배포하기 전에 effort 수준을 선택하세요

Effort는 품질, 지연 시간 및 비용을 조절하는 주요 수치입니다. Haiku 5.5에서는 각 레벨 간의 격차가 큽니다.

대표 벤치마크 점수는 max effort 기준입니다

Anthropic의 출시 수치는 max effort를 사용합니다. 기본 medium effort에서 Anthropic은 1620 대신 1277의 GDPval-AA Elo를 보고합니다. 벤치마크 결과를 확인할 때는 effort 수준을 염두에 두세요.

max는 토큰 소모량이 많습니다

Artificial Analysis에 따르면 max effort에서 Intelligence Index 작업당 약 162K 출력 토큰이 측정되었으며, 이는 max 기준 GPT-6 Luna의 약 3배에 달합니다. medium에서는 초당 약 137개의 출력 토큰이 측정되었습니다.

low 또는 medium으로 시작하세요

분류, 추출, 라우팅 작업의 경우 thinking을 비활성화한 low 또는 medium을 사용하면 지연 시간과 비용을 낮출 수 있습니다. 품질이 부족한 작업에만 더 높은 수준으로 전환하세요.

Claude Haiku 5.5 API 호출 방법

엔드포인트가 Anthropic Messages 프로토콜을 지원하므로, 기존 Claude 클라이언트는 새 base URL과 키만 있으면 됩니다.

01

키를 발급받고 클라이언트가 AIReiter를 가리키도록 설정하세요

AIReiter 대시보드에서 API 키를 생성하세요. 공식 Anthropic SDK에서 기본 URL을 https://aireiter.com/api 로 설정하면 SDK가 자동으로 /v1/messages 를 추가합니다.

02

curl로 요청 보내기

curl https://aireiter.com/api/v1/messages \ -H "x-api-key: $AIREITER_API_KEY" \ -H "anthropic-version: 2023-06-01" \ -H "content-type: application/json" \ -d '{ "model": "claude-haiku-5-5", "max_tokens": 4096, "output_config": {"effort": "low"}, "messages": [{"role": "user", "content": "Hello"}] }'

03

또는 Python SDK 사용

from anthropic import Anthropic client = Anthropic(api_key="YOUR_AIREITER_KEY", base_url="https://aireiter.com/api") msg = client.messages.create( model="claude-haiku-5-5", max_tokens=4096, messages=[{"role": "user", "content": "Hello"}], ) print(next(b.text for b in msg.content if b.type == "text"))

Claude Haiku 5.5 API FAQ

/ 01

Claude Haiku 5.5는 언제 출시되었으며 모델 ID는 무엇인가요?

Anthropic은 2026년 10월 7일에 출시했습니다. API 모델 ID는 claude-haiku-5-5이며, 지식 컷오프는 2026년 6월입니다. Anthropic에 따르면 2027년 10월 7일 이전에는 서비스가 중단되지 않습니다.

/ 02

컨텍스트 윈도우와 최대 출력은 어떻게 되나요?

1M 토큰 컨텍스트 윈도우와 요청당 최대 128K 출력 토큰을 지원합니다. 텍스트 및 이미지 입력을 허용하고 텍스트를 반환합니다.

/ 03

Claude Haiku 5.5 API 비용은 얼마인가요?

Anthropic은 100K 입력 토큰 이하의 요청에 대해 100만 토큰당 입력 $0.10, 출력 $0.50를 책정하고 있으며, 100K를 초과하는 경우 5배가 부과됩니다. AIReiter는 그 절반인 $0.05 및 $0.25, 100K 초과 시 $0.25 및 $1.25를 부과합니다.

/ 04

특정 요청의 비용이 5배 더 많이 나온 이유는 무엇인가요?

총 입력이 100K 토큰을 초과하여 요청 전체에 롱 컨텍스트(long-context) 요율이 청구되었습니다. 캐시된 토큰도 100K 한도에 포함됩니다.

/ 05

답변이 thinking 블록으로 시작하는 이유는 무엇인가요?

적응형 thinking(Adaptive thinking)이 기본적으로 활성화되어 있어 응답 텍스트 앞에 thinking 블록이 포함될 수 있습니다. content[0]을 직접 가져오는 대신 유형별(type)로 콘텐츠 블록을 읽거나 low, medium, high effort에서 thinking을 비활성화하세요.

/ 06

Haiku 5.5는 코딩 작업에 적합한가요?

범위가 명확하고 작은 규모의 수정 작업이나 하위 에이전트 단계에는 대개 충분합니다. 복잡한 다중 파일 작업의 경우 Anthropic은 동일한 키로 사용 가능한 Sonnet 5.5 또는 Opus 5.5를 권장합니다.

/ 07

Anthropic 계정이 필요한가요?

아닙니다. AIReiter 키는 AIReiter 엔드포인트에서 작동하며, 코드를 작성하기 전에 이 페이지의 플레이그라운드에서 모델을 테스트해 볼 수 있습니다.

/ 08

어떤 API가 지원되나요?

/api/v1/messages의 Anthropic Messages가 스트리밍을 지원하는 기본 규격입니다. OpenAI 스타일의 Chat Completions 및 Responses API도 제공되며, /api/v1/models는 보유한 키로 사용할 수 있는 모델 목록을 반환합니다.