Claude Haiku 5.5の新機能
AnthropicはHaiku 4.5のリリースから1年後となる2026年10月7日にClaude Haiku 5.5をリリースしました。短いプロンプトにおける価格が90%削減され、性能面でもSonnetに大幅に近づきました。
エフォート制御に対応した初のHaiku
Haiku 5.5はアダプティブシンキングと5段階のエフォートレベル(low、medium、high、xhigh、max)を採用しています。デフォルトはmediumです。以前のHaikuモデルにはエフォート設定がありませんでした。
1Mコンテキストと128K出力
コンテキストウィンドウはHaiku 4.5の200Kトークンから1Mへと拡大し、最大出力は64Kから128Kに増加しました。テキストと画像の入力に対応しています。ナレッジカットオフは2026年6月です。
エージェント業務およびオフィスワークでの大幅な飛躍
Anthropicの報告によると、最大エフォート時においてOSWorld 2.1で72.4%(Haiku 4.5は15.7%)、GDPval-AA Eloで1620(Haiku 4.5は735)を記録しました。なお、Anthropicが公表したすべてのベンチマークにおいて、依然としてSonnet 5.5がリードしています。
第三者機関によるスコア
Artificial AnalysisのIntelligence Indexにおいて、Haiku 5.5は最大エフォートで43(Haiku 4.5の17から上昇)、デフォルトのmediumエフォートで34のスコアを獲得しています。
Claude Haiku 5.5 vs Haiku 4.5 vs Sonnet 5.5
これらはすべて同じAIReiterキーで動作するため、modelフィールドを変更するだけで切り替えが可能です。
Haiku 5.5 vs Haiku 4.5
Haiku 4.5の定価は100万トークンあたり入力$1、出力$5です。Haiku 5.5は100Kトークンまでのプロンプトで$0.10および$0.50となっています。同一テキストに対して約30%多くのトークンを生成する新しいトークナイザーを考慮しても、実際のワークロードコストは約75%削減されるとAnthropicは試算しています。
Haiku 5.5 vs Sonnet 5.5
ここでのSonnet 5.5は100万トークンあたり入力$1.00、出力$5.00であり、Haiku 5.5の基本料金の20倍です。Anthropicは複雑なコーディングには引き続きSonnet 5.5またはOpus 5.5を推奨しています。Haiku 5.5は分類、抽出、要約、ルーティング、サブエージェントのステップに最適です。
Haiku 5.5 vs GPT-6 Luna
両者とも定価は入力$0.10、出力$0.50です。Anthropicのレポートでは、OSWorld 2.1(72.4% vs 48.9%)およびGDPval-AA(1620 vs 1437)でHaiku 5.5が優位に立っています。Artificial Analysisは、Haiku 5.5が同等のスコアを達成するためにLunaよりも多くの出力トークンを消費すると指摘しているため、実際のタスクで比較検証することをおすすめします。
AIReiterにおけるClaude Haiku 5.5 API料金
すべての項目がAnthropic定価の50%で請求されます。適用される料金レートは、単一リクエストが送信する入力トークン数によって決まります。
100K入力トークンまで
入力 $0.05(定価 $0.10)。出力 $0.25(定価 $0.50)。キャッシュ読み取り $0.005(定価 $0.01)。キャッシュ書き込み $0.0625(定価 $0.125)。すべて100万トークンあたりの料金です。
100K入力トークン超:各料金が5倍
入力 $0.25(定価 $0.50)。出力 $1.25(定価 $2.50)。キャッシュ読み取り $0.025(定価 $0.05)。キャッシュ書き込み $0.3125(定価 $0.625)。ティアはキャッシュされたトークンを含むリクエストごとの総入力数によって決定され、リクエスト全体に適用されます。
2つの実際の呼び出し例
50K入力+5K出力の場合、ここでの費用は$0.00375です(定価では$0.0075)。200K入力+10K出力の場合はロングコンテキストティアに該当し、ここでの費用は$0.0625です(定価では$0.125)。長いジョブを100K未満のリクエストに分割できる場合、コストは5分の1になります。
実際に使用したトークン数に応じた請求
呼び出し開始時に概算額が確保され、レスポンス完了時に実際のトークン数に基づいて精算され、差額が返金されます。シンキングトークンは出力として課金されます。
Haiku 4.5からの移行:エラーを返すようになった項目
モデル文字列を claude-haiku-5-5 に変更するだけでは不十分な場合があります。以下のリクエスト形式はHaiku 4.5では機能していましたが、Haiku 5.5では拒否されます。
temperature、top_p、top_kの削除
デフォルト以外のサンプリング値を指定すると、「deprecated for this model」という400エラーが返されます。これらのフィールドを削除し、プロンプトとeffortレベルで出力を制御してください。
アシスタントの事前入力(prefill)は不可
アシスタントメッセージで終わる会話は400エラーを返します。最後のメッセージはユーザーからのものである必要があります。フォーマットを指定したい場合は、構造化出力(structured outputs)を使用するか、プロンプト内で指示してください。
thinking budgetをeffortに置き換える
AnthropicのAPIはこのモデルで thinking: {"type": "enabled", "budget_tokens": N} を拒否するため、これを削除して代わりに output_config.effort を設定してください。Thinkingトークンは依然として max_tokens から消費されるため、回答が途切れる場合は max_tokens を増やしてください。
thinkingをオフにするとeffortの上限はhighになる
thinking: {"type": "disabled"} は low、medium、high のeffortで動作します。xhigh や max を指定すると400エラーが返されます。Sonnet 5.5で使用される between_tools thinking モードは Haiku 5.5 ではサポートされていません。強制的な tool_choice は引き続き機能します。
リリース前に effort レベルを選択する
Effortは品質、レイテンシ、コストを調整する主要なパラメータです。Haiku 5.5では、各レベル間の差が大きくなっています。
主要スコアはmax effort時のもの
Anthropicの発表スコアにはmax effortが使用されています。デフォルトのmedium effortでは、Anthropicが報告するGDPval-AA Eloスコアは1620ではなく1277となります。ベンチマーク結果を見る際は、effortレベルを念頭に置いてご確認ください。
maxはトークン消費量が多い
Artificial Analysisの測定によると、max effortでのIntelligence Indexタスクあたりの出力トークン数は約162Kトークンで、max時のGPT-6 Lunaの約3倍に達します。mediumでの出力速度は約137トークン/秒と測定されました。
lowまたはmediumから始める
分類、抽出、ルーティングなどのタスクでは、thinkingを無効化したlowまたはmediumを使用することでレイテンシとコストを低く抑えられます。品質が不十分なタスクでのみレベルを引き上げてください。
Claude Haiku 5.5 APIの呼び出し方法
エンドポイントは Anthropic Messages プロトコルに対応しているため、既存の Claude クライアントではベース URL と API キーを変更するだけで利用できます。
キーを取得し、クライアントの接続先を AIReiter に指定
AIReiter ダッシュボードで API キーを作成します。Anthropic 公式 SDK ではベース URL を https://aireiter.com/api に設定してください(SDK が自動的に /v1/messages を付加します)。
curl でリクエストを送信
curl https://aireiter.com/api/v1/messages \ -H "x-api-key: $AIREITER_API_KEY" \ -H "anthropic-version: 2023-06-01" \ -H "content-type: application/json" \ -d '{ "model": "claude-haiku-5-5", "max_tokens": 4096, "output_config": {"effort": "low"}, "messages": [{"role": "user", "content": "Hello"}] }'
または Python SDK を使用
from anthropic import Anthropic client = Anthropic(api_key="YOUR_AIREITER_KEY", base_url="https://aireiter.com/api") msg = client.messages.create( model="claude-haiku-5-5", max_tokens=4096, messages=[{"role": "user", "content": "Hello"}], ) print(next(b.text for b in msg.content if b.type == "text"))
Claude Haiku 5.5 API FAQ
/ 01Claude Haiku 5.5はいつリリースされましたか?モデルIDは何ですか?
Anthropicは2026年10月7日にリリースしました。APIのモデルIDは claude-haiku-5-5 で、ナレッジカットオフは2026年6月です。Anthropicによると、2027年10月7日より前に廃止されることはありません。
/ 02コンテキストウィンドウと最大出力数はどれくらいですか?
100 万(1M)トークンのコンテキストウィンドウと、リクエストあたり最大 128K の出力トークンに対応しています。テキストおよび画像の入力を受け付け、テキストを返します。
/ 03Claude Haiku 5.5 APIの料金はいくらですか?
Anthropicの定価は、入力トークン数が100Kまでのリクエストの場合、100万トークンあたり入力$0.10、出力$0.50で、100Kを超える場合はその5倍となります。AIReiterは半額の料金($0.05と$0.25、100K超は$0.25と$1.25)で提供しています。
/ 04特定のリクエストの料金が5倍になったのはなぜですか?
合計入力トークン数が100Kトークンを超えたため、リクエスト全体にロングコンテキスト料金が適用されました。キャッシュされたトークンも100Kの上限カウントに含まれます。
/ 05回答の先頭にthinkingブロックが含まれるのはなぜですか?
アダプティブシンキング(Adaptive thinking)がデフォルトで有効になっているため、レスポンスのテキストの前にthinkingブロックが含まれることがあります。content[0] を直接取得するのではなくタイプ別にコンテンツブロックを読み取るか、low、medium、high のeffortでthinkingを無効にしてください。
/ 06Haiku 5.5はコーディングに適していますか?
範囲が明確で小規模な編集やサブエージェントのステップであれば、多くの場合十分です。複雑な複数ファイルにまたがる作業には、Sonnet 5.5 または Opus 5.5 の使用がAnthropicより推奨されています(いずれも同じキーで利用可能です)。
/ 07Anthropicのアカウントは必要ですか?
いいえ。AIReiterキーはAIReiterエンドポイントに対して有効であり、コードを書く前にこのページのPlaygroundでモデルを試すことができます。
/ 08どのAPIがサポートされていますか?
/api/v1/messages のAnthropic Messagesが主要な仕様であり、ストリーミングに対応しています。OpenAIスタイルのChat CompletionsやResponses APIもサポートされており、/api/v1/models でお使いのキーで利用可能なモデル一覧を確認できます。