Claude Sonnet 5.5の新機能・改善点
Anthropicは2026年9月28日、Sonnet 5の直接の後継アップグレードとしてClaude Sonnet 5.5をリリースしました。定価は据え置きのまま、処理能力の向上とトークン消費の効率化が実現されています。
ナレッジワークにおいてOpus 5.5に肉薄
Anthropicの報告によると、Sonnet 5.5のGDPval-AAスコアは1844で、Opus 5.5(1846)にわずか2ポイント差まで迫り、Sonnet 5(1449)を約400ポイント上回っています。また、持続的な判断力を要する自由度の高い作業においては、依然としてOpus 5.5が明確に優位であるとも述べています。
コーディング性能の大幅な向上
CursorBench 4.0において、AnthropicはSonnet 5.5のスコアを55.5%と報告しており、これはSonnet 5の34.1%を上回り、Opus 5.5の57.8%に迫るものです。Anthropicは本モデルを、機能開発、バグ修正、ドキュメント・スライド・スプレッドシートの作成など、範囲が明確な日常業務向けと位置付けています。
同一タスクにおけるトークン消費量の削減
初期導入企業からも、実運用環境でのコスト削減が報告されています。Slackではプロンプトの変更なしに出力トークンが約14%減少し、Balyasny Asset Managementは2,441件の金融タスクにおいて、Sonnet 5の1回答あたり497Kトークンに対し、Sonnet 5.5では約121Kトークンに抑えられたと測定しています。
出力速度の向上、トークナイザーは共通
Anthropicによると、出力速度はSonnet 5より30%以上高速化されており、Artificial Analysisの測定では1秒あたり約139出力トークンを記録しました。トークナイザーは変更されていないため、同一テキストのトークン数は両モデルで同じになります。
Claude Sonnet 5.5 vs Sonnet 5 vs Opus 5.5
3つのモデルはすべて同じAIReiterキーで利用できます。要約すると、以下の移行チェック項目をクリアでき次第Sonnet 5から移行し、最も難易度の高いオープンエンドな作業にはOpus 5.5を残しておくのが最適です。
Sonnet 5.5 vs Sonnet 5:同価格でより多くの処理を実現
どちらも定価は100万トークンあたり入力$2、出力$10です。Sonnet 5.5は上記のコーディングやナレッジワークのベンチマークで高いスコアを記録し、通常より少ないトークン数で完了するため、同じ作業でも実質コストが下がる傾向にあります。
Sonnet 5.5 vs Opus 5.5:半額のコスト
当サービスでは、Sonnet 5.5が100万トークンあたり入力$1.00、出力$5.00、Opus 5.5が入力$2.00、出力$10.00です。どちらも100万トークンのコンテキストウィンドウと最大128Kの出力に対応しているため、移行はmodelフィールドを変更するだけで完了します。
引き続きOpus 5.5を選ぶべきケース
モデル自身が計画を立て、自身の誤りに気付き、作業を継続する必要がある、長期にわたる曖昧なタスクです。Base44の報告では、アプリ構築あたりの反復回数がOpus 5の7.7回に対し、Sonnet 5.5では3.6回でした。そのため、まずはSonnet 5.5を試し、うまくいかないタスクのみOpusにエスカレーションすることをお勧めします。
当面Sonnet 5を使い続けるべきケース
コード側でthinkingを無効化している、特定のtoolを強制指定している、またはtemperatureを設定している場合、それらを変更しない限りSonnet 5.5でのリクエストはエラーになります。また、セキュリティツールで拒否応答が増える可能性もあります。まずこれらを修正してから移行してください。
Sonnet 5 からの移行:エラーになる変更点
モデル文字列を claude-sonnet-5-5 に変更するだけでは不十分な場合があります。Sonnet 5 で動作していた以下のリクエスト形式は、Sonnet 5.5 では拒否されます。
thinking: disabled は400エラーを返す
アダプティブシンキング(Adaptive thinking)は常に有効です。{"type": "disabled"} は、初回答前の思考をスキップする最低設定の {"type": "between_tools"} に置き換えてください。between_tools は low、medium、high の effort でのみ動作します。xhigh または max の場合は、thinking を省略するか {"type": "adaptive"} を送信してください。
手動でのthinking budget設定は400エラーを返す
thinking: {"type": "enabled", "budget_tokens": N} は拒否されます。代わりに effort レベルで深さを制御してください。思考トークンは引き続き max_tokens から消費され出力として課金されるため、回答が途切れるようになった場合は max_tokens を増やしてください。
ツールの強制選択(Forced tool choice)は拒否される
特定のツールを強制する tool_choice はエラーを返すようになりました。厳密なツール定義とともに自動ツール選択を使用し、呼び出しのタイミングはモデルに判断させてください。
カスタムのtemperature、top_p、top_kは400エラーを返す
デフォルトのサンプリング設定のみが受け付けられます。これらのフィールドを固定値に設定するのではなく、リクエストから削除してください。なお、有利な変更点として、キャッシュ可能な最小プロンプトサイズが1,024トークンから512トークンに引き下げられました。
リリース前に effort レベルを選択する
現在、effort はコストとレイテンシを調整する主要な設定項目となっています。low、medium、high、xhigh、max の 5 つのレベルがあります。
API のデフォルトは high
effort を指定しない場合、API は high で実行されます。Claude Code および Claude アプリのデフォルトは medium です。請求額がデフォルト設定に左右されないよう、output_config.effort を明示的に設定してください。
max は高コスト
Artificial Analysis の測定によると、max effort では定価ベースでタスクあたり $7.60、インデックス全体で中央値 88M トークンに対して 410M の出力トークンを消費しました。Anthropic がアピールする効率性の高さは下位レベルに関するものであり、max には当てはまりません。
medium から始めて測定し、調整する
実際のタスクを medium で実行して品質を確認し、不足がある場合にのみレベルを引き上げてください。レイテンシに敏感なツールループの場合、low または between_tools 思考を有効にした medium を使用することで、初期応答を高速に保つことができます。
AIReiter での Claude Sonnet 5.5 API 料金
すべての項目が Anthropic 定価の 50% で請求されます。モデルも Messages プロトコルも同一です。
全項目で定価の半額
入力 $1.00(定価 $2.00)。出力 $5.00(定価 $10.00)。キャッシュ読み取り $0.10(定価 $0.20)。キャッシュ書き込み $1.25(定価 $2.50)。すべて 100 万トークンあたりの料金です。
実際の呼び出し例:$3.00 ではなく $1.50
100 万の入力トークンと 10 万の出力トークンの場合、Anthropic の定価では $3.00 ですが、当サービスでは $1.50 で済みます。同じ呼び出しを当サービスの Opus 5.5 で行うと $3.00 になります。
実際に使用したトークン数に応じた請求
呼び出し開始時に概算枠が確保され、レスポンス完了時に実際のトークン数に基づいて決済され、差額が返金されます。料金レートは 1 トークン目から 100 万トークン目まで同一で、ロングコンテキストによる階層料金はありません。
Claude Sonnet 5.5 API の呼び出し方法
エンドポイントは Anthropic Messages プロトコルに対応しているため、既存の Claude クライアントではベース URL と API キーを変更するだけで利用できます。
キーを取得し、クライアントの接続先を AIReiter に指定
AIReiter ダッシュボードで API キーを作成します。Anthropic 公式 SDK ではベース URL を https://aireiter.com/api に設定してください(SDK が自動的に /v1/messages を付加します)。
curl でリクエストを送信
curl https://aireiter.com/api/v1/messages \ -H "x-api-key: $AIREITER_API_KEY" \ -H "anthropic-version: 2023-06-01" \ -H "content-type: application/json" \ -d '{ "model": "claude-sonnet-5-5", "max_tokens": 4096, "output_config": {"effort": "medium"}, "messages": [{"role": "user", "content": "Hello"}] }'
または Python SDK を使用
from anthropic import Anthropic client = Anthropic(api_key="YOUR_AIREITER_KEY", base_url="https://aireiter.com/api") msg = client.messages.create( model="claude-sonnet-5-5", max_tokens=4096, messages=[{"role": "user", "content": "Hello"}], ) print(msg.content[0].text)
Claude Sonnet 5.5 API よくある質問
/ 01Claude Sonnet 5.5 はいつリリースされましたか?またモデル ID は何ですか?
Anthropic は 2026年9月28日にリリースしました。API のモデル ID は claude-sonnet-5-5 で、ナレッジカットオフは 2026年6月です。
/ 02コンテキストウィンドウと最大出力数はどれくらいですか?
100 万(1M)トークンのコンテキストウィンドウと、リクエストあたり最大 128K の出力トークンに対応しています。テキストおよび画像の入力を受け付け、テキストを返します。
/ 03Claude Sonnet 5.5 APIの料金はいくらですか?
Anthropicの定価は100万トークンあたり入力2ドル、出力10ドルで、Sonnet 5と同額です。AIReiterでは半額の入力1ドル、出力5ドル、キャッシュ読み取り0.10ドル、キャッシュ書き込み1.25ドルで提供しています。
/ 04思考(thinking)機能をオフにすることはできますか?
完全には無効化できません。thinking disabled は400エラーを返します。最も低い設定は between_tools で、low、medium、high の各effortで動作します。
/ 05Sonnet 5.5はSonnet 5よりも優れていますか?
Anthropicが報告しているコーディングや知識作業のベンチマークにおいて、同定価でありながら大幅に優れています。ただし、一部のSonnet 5のリクエスト形式はエラーになるため、切り替え前に上記の移行に関する変更点をご確認ください。
/ 06セキュリティに関する質問が拒否されたり、Sonnet 5によって回答されたりしたのはなぜですか?
Sonnet 5.5は、Anthropicの最高性能モデルに適用されているサイバーセキュリティセーフガードを搭載した初のSonnetモデルです。リスクが高いとされる一部のリクエストはSonnet 5にフォールバックされ、無害なセキュリティタスクでも拒否が増える可能性があります。これはアップストリームの仕様動作です。
/ 07Anthropicのアカウントは必要ですか?
いいえ。AIReiterキーはAIReiterエンドポイントに対して有効であり、コードを書く前にこのページのPlaygroundでモデルを試すことができます。
/ 08どのAPIがサポートされていますか?
/api/v1/messages のAnthropic Messagesが主要な仕様であり、ストリーミングに対応しています。OpenAIスタイルのChat CompletionsやResponses APIもサポートされており、/api/v1/models でお使いのキーで利用可能なモデル一覧を確認できます。