AIREITER
AnthropicText Chat

Claude Sonnet 5.5

Anthropicの定価の半額で利用できるClaude Sonnet 5.5 API:100万トークンあたり入力$1、出力$5。Sonnet 5からの変更点、ベンチマーク、破壊的変更、動作コードを解説。

入力公式 $2.00 100万トークンあたりAIReiter $1.00 100万トークンあたり出力公式 $10.00 100万トークンあたりAIReiter $5.00 100万トークンあたりキャッシュ読み取り公式 $0.20 100万トークンあたりAIReiter $0.10 100万トークンあたりキャッシュ作成公式 $2.50 100万トークンあたりAIReiter $1.25 100万トークンあたり
APIで実行

入力

出力

Example
Generated in
42.7 seconds
入力 Token
134
出力 Token
2354
Tokens per second
55.13 tokens / second
Time to first token
-

モデル詳細

Playground、APIリクエスト、社内ワークフローで同じモデルキーを使用してください。

モデル ID
claude-sonnet-5-5
プロバイダー
Anthropic
プロトコル
Anthropic Messages
コンテキストウィンドウ
1,000,000 トークン
最大出力
128,000 トークン
入力 Token
100 credits / 100万トークン
出力 Token
500 credits / 100万トークン
キャッシュ読み取り
10 credits / 100万トークン
キャッシュ書き込み
125 credits / 100万トークン

Claude Sonnet 5.5の新機能・改善点

Anthropicは2026年9月28日、Sonnet 5の直接の後継アップグレードとしてClaude Sonnet 5.5をリリースしました。定価は据え置きのまま、処理能力の向上とトークン消費の効率化が実現されています。

ナレッジワークにおいてOpus 5.5に肉薄

Anthropicの報告によると、Sonnet 5.5のGDPval-AAスコアは1844で、Opus 5.5(1846)にわずか2ポイント差まで迫り、Sonnet 5(1449)を約400ポイント上回っています。また、持続的な判断力を要する自由度の高い作業においては、依然としてOpus 5.5が明確に優位であるとも述べています。

コーディング性能の大幅な向上

CursorBench 4.0において、AnthropicはSonnet 5.5のスコアを55.5%と報告しており、これはSonnet 5の34.1%を上回り、Opus 5.5の57.8%に迫るものです。Anthropicは本モデルを、機能開発、バグ修正、ドキュメント・スライド・スプレッドシートの作成など、範囲が明確な日常業務向けと位置付けています。

同一タスクにおけるトークン消費量の削減

初期導入企業からも、実運用環境でのコスト削減が報告されています。Slackではプロンプトの変更なしに出力トークンが約14%減少し、Balyasny Asset Managementは2,441件の金融タスクにおいて、Sonnet 5の1回答あたり497Kトークンに対し、Sonnet 5.5では約121Kトークンに抑えられたと測定しています。

出力速度の向上、トークナイザーは共通

Anthropicによると、出力速度はSonnet 5より30%以上高速化されており、Artificial Analysisの測定では1秒あたり約139出力トークンを記録しました。トークナイザーは変更されていないため、同一テキストのトークン数は両モデルで同じになります。

Claude Sonnet 5.5 vs Sonnet 5 vs Opus 5.5

3つのモデルはすべて同じAIReiterキーで利用できます。要約すると、以下の移行チェック項目をクリアでき次第Sonnet 5から移行し、最も難易度の高いオープンエンドな作業にはOpus 5.5を残しておくのが最適です。

Sonnet 5.5 vs Sonnet 5:同価格でより多くの処理を実現

どちらも定価は100万トークンあたり入力$2、出力$10です。Sonnet 5.5は上記のコーディングやナレッジワークのベンチマークで高いスコアを記録し、通常より少ないトークン数で完了するため、同じ作業でも実質コストが下がる傾向にあります。

Sonnet 5.5 vs Opus 5.5:半額のコスト

当サービスでは、Sonnet 5.5が100万トークンあたり入力$1.00、出力$5.00、Opus 5.5が入力$2.00、出力$10.00です。どちらも100万トークンのコンテキストウィンドウと最大128Kの出力に対応しているため、移行はmodelフィールドを変更するだけで完了します。

引き続きOpus 5.5を選ぶべきケース

モデル自身が計画を立て、自身の誤りに気付き、作業を継続する必要がある、長期にわたる曖昧なタスクです。Base44の報告では、アプリ構築あたりの反復回数がOpus 5の7.7回に対し、Sonnet 5.5では3.6回でした。そのため、まずはSonnet 5.5を試し、うまくいかないタスクのみOpusにエスカレーションすることをお勧めします。

当面Sonnet 5を使い続けるべきケース

コード側でthinkingを無効化している、特定のtoolを強制指定している、またはtemperatureを設定している場合、それらを変更しない限りSonnet 5.5でのリクエストはエラーになります。また、セキュリティツールで拒否応答が増える可能性もあります。まずこれらを修正してから移行してください。

Sonnet 5 からの移行:エラーになる変更点

モデル文字列を claude-sonnet-5-5 に変更するだけでは不十分な場合があります。Sonnet 5 で動作していた以下のリクエスト形式は、Sonnet 5.5 では拒否されます。

thinking: disabled は400エラーを返す

アダプティブシンキング(Adaptive thinking)は常に有効です。{"type": "disabled"} は、初回答前の思考をスキップする最低設定の {"type": "between_tools"} に置き換えてください。between_tools は low、medium、high の effort でのみ動作します。xhigh または max の場合は、thinking を省略するか {"type": "adaptive"} を送信してください。

手動でのthinking budget設定は400エラーを返す

thinking: {"type": "enabled", "budget_tokens": N} は拒否されます。代わりに effort レベルで深さを制御してください。思考トークンは引き続き max_tokens から消費され出力として課金されるため、回答が途切れるようになった場合は max_tokens を増やしてください。

ツールの強制選択(Forced tool choice)は拒否される

特定のツールを強制する tool_choice はエラーを返すようになりました。厳密なツール定義とともに自動ツール選択を使用し、呼び出しのタイミングはモデルに判断させてください。

カスタムのtemperature、top_p、top_kは400エラーを返す

デフォルトのサンプリング設定のみが受け付けられます。これらのフィールドを固定値に設定するのではなく、リクエストから削除してください。なお、有利な変更点として、キャッシュ可能な最小プロンプトサイズが1,024トークンから512トークンに引き下げられました。

リリース前に effort レベルを選択する

現在、effort はコストとレイテンシを調整する主要な設定項目となっています。low、medium、high、xhigh、max の 5 つのレベルがあります。

API のデフォルトは high

effort を指定しない場合、API は high で実行されます。Claude Code および Claude アプリのデフォルトは medium です。請求額がデフォルト設定に左右されないよう、output_config.effort を明示的に設定してください。

max は高コスト

Artificial Analysis の測定によると、max effort では定価ベースでタスクあたり $7.60、インデックス全体で中央値 88M トークンに対して 410M の出力トークンを消費しました。Anthropic がアピールする効率性の高さは下位レベルに関するものであり、max には当てはまりません。

medium から始めて測定し、調整する

実際のタスクを medium で実行して品質を確認し、不足がある場合にのみレベルを引き上げてください。レイテンシに敏感なツールループの場合、low または between_tools 思考を有効にした medium を使用することで、初期応答を高速に保つことができます。

AIReiter での Claude Sonnet 5.5 API 料金

すべての項目が Anthropic 定価の 50% で請求されます。モデルも Messages プロトコルも同一です。

全項目で定価の半額

入力 $1.00(定価 $2.00)。出力 $5.00(定価 $10.00)。キャッシュ読み取り $0.10(定価 $0.20)。キャッシュ書き込み $1.25(定価 $2.50)。すべて 100 万トークンあたりの料金です。

実際の呼び出し例:$3.00 ではなく $1.50

100 万の入力トークンと 10 万の出力トークンの場合、Anthropic の定価では $3.00 ですが、当サービスでは $1.50 で済みます。同じ呼び出しを当サービスの Opus 5.5 で行うと $3.00 になります。

実際に使用したトークン数に応じた請求

呼び出し開始時に概算枠が確保され、レスポンス完了時に実際のトークン数に基づいて決済され、差額が返金されます。料金レートは 1 トークン目から 100 万トークン目まで同一で、ロングコンテキストによる階層料金はありません。

Claude Sonnet 5.5 API の呼び出し方法

エンドポイントは Anthropic Messages プロトコルに対応しているため、既存の Claude クライアントではベース URL と API キーを変更するだけで利用できます。

01

キーを取得し、クライアントの接続先を AIReiter に指定

AIReiter ダッシュボードで API キーを作成します。Anthropic 公式 SDK ではベース URL を https://aireiter.com/api に設定してください(SDK が自動的に /v1/messages を付加します)。

02

curl でリクエストを送信

curl https://aireiter.com/api/v1/messages \ -H "x-api-key: $AIREITER_API_KEY" \ -H "anthropic-version: 2023-06-01" \ -H "content-type: application/json" \ -d '{ "model": "claude-sonnet-5-5", "max_tokens": 4096, "output_config": {"effort": "medium"}, "messages": [{"role": "user", "content": "Hello"}] }'

03

または Python SDK を使用

from anthropic import Anthropic client = Anthropic(api_key="YOUR_AIREITER_KEY", base_url="https://aireiter.com/api") msg = client.messages.create( model="claude-sonnet-5-5", max_tokens=4096, messages=[{"role": "user", "content": "Hello"}], ) print(msg.content[0].text)

Claude Sonnet 5.5 API よくある質問

/ 01

Claude Sonnet 5.5 はいつリリースされましたか?またモデル ID は何ですか?

Anthropic は 2026年9月28日にリリースしました。API のモデル ID は claude-sonnet-5-5 で、ナレッジカットオフは 2026年6月です。

/ 02

コンテキストウィンドウと最大出力数はどれくらいですか?

100 万(1M)トークンのコンテキストウィンドウと、リクエストあたり最大 128K の出力トークンに対応しています。テキストおよび画像の入力を受け付け、テキストを返します。

/ 03

Claude Sonnet 5.5 APIの料金はいくらですか?

Anthropicの定価は100万トークンあたり入力2ドル、出力10ドルで、Sonnet 5と同額です。AIReiterでは半額の入力1ドル、出力5ドル、キャッシュ読み取り0.10ドル、キャッシュ書き込み1.25ドルで提供しています。

/ 04

思考(thinking)機能をオフにすることはできますか?

完全には無効化できません。thinking disabled は400エラーを返します。最も低い設定は between_tools で、low、medium、high の各effortで動作します。

/ 05

Sonnet 5.5はSonnet 5よりも優れていますか?

Anthropicが報告しているコーディングや知識作業のベンチマークにおいて、同定価でありながら大幅に優れています。ただし、一部のSonnet 5のリクエスト形式はエラーになるため、切り替え前に上記の移行に関する変更点をご確認ください。

/ 06

セキュリティに関する質問が拒否されたり、Sonnet 5によって回答されたりしたのはなぜですか?

Sonnet 5.5は、Anthropicの最高性能モデルに適用されているサイバーセキュリティセーフガードを搭載した初のSonnetモデルです。リスクが高いとされる一部のリクエストはSonnet 5にフォールバックされ、無害なセキュリティタスクでも拒否が増える可能性があります。これはアップストリームの仕様動作です。

/ 07

Anthropicのアカウントは必要ですか?

いいえ。AIReiterキーはAIReiterエンドポイントに対して有効であり、コードを書く前にこのページのPlaygroundでモデルを試すことができます。

/ 08

どのAPIがサポートされていますか?

/api/v1/messages のAnthropic Messagesが主要な仕様であり、ストリーミングに対応しています。OpenAIスタイルのChat CompletionsやResponses APIもサポートされており、/api/v1/models でお使いのキーで利用可能なモデル一覧を確認できます。