Claude Sonnet 5をAPIで使うなら、料金前提を更新しておきたい。Anthropicは2026年8月10日、9月1日に予定していた値上げを撤回した。1M入力トークン$2、1M出力トークン$10は導入キャンペーン価格ではなく、今後の標準料金となる。6月のリリース時に報じられた$3/$15を前提に第4四半期のAPI予算を組んでいた場合は修正が必要であり、「本来の価格」になるまで待つためSonnet 4.6を使い続けていたなら、その判断材料も変わった。
Claude Sonnet 5の現行料金一覧
AnthropicのファーストパーティAPIにおけるClaude Sonnet 5の基本料金は、入力1Mトークンあたり$2、出力1Mトークンあたり$10だ。割引料金もすべてこの基本価格を基準に設定されている。2026年8月16日に確認したClaude Platformの料金ドキュメントには、「Previously scheduled increase ... will not occur.」と明記されている。
| 区分 | 1Mトークンあたりの料金 | 基本入力料金との比較 |
|---|---|---|
| 基本入力 | $2.00 | 1.0倍 |
| 基本出力 | $10.00 | 入力の5倍 |
| 5分キャッシュ書き込み | $2.50 | 1.25倍 |
| 1時間キャッシュ書き込み | $4.00 | 2倍 |
| キャッシュ読み取り(ヒット時) | $0.20 | 0.1倍 |
| Batch入力 | $1.00 | 50%割引 |
| Batch出力 | $5.00 | 50%割引 |
見出しの料金だけでは分かりにくい点も3つある。まず、1Mトークンのフルコンテキストウィンドウでも単価は同じで、900kトークンのリクエストでも9kトークンのリクエストでも、トークン単価に長大コンテキスト向けの追加料金はない。次に、inference_geo: "us"で推論を米国に固定すると、入力・出力・キャッシュ料金すべてに1.1倍の係数が加わる。さらに、サーバーサイドのWeb検索は通常のトークン料金に加え、1,000検索あたり$10がかかる。
9月1日の値上げは撤回された
Claude Sonnet 5は2026年6月30日、入力$2/出力$10の「導入価格」で登場した。当初は9月1日にSonnet 4.6と同じ$3/$15へ戻る予定と明示されており、7月上旬に公開された料金表の多くには今もこの数字が残っている。だが2026年8月10日、リリース発表の更新履歴に、導入価格を恒久化する一文が追加された。TechCrunchのリリース記事にも、現行料金を反映する更新注記が付いている。
いまなお$3/$15への移行を「予定」や「8月31日以降」と記載する料金表は、8月10日以前の情報と見てよい。標準料金を入力・出力とも50%高く見積もることになる。期限がなくなった以外に料金体系の変更はなく、Sonnet 5の$2/$10はSonnet 4.6の$3/$15より1段低い価格帯だ。入力料金で見れば33%安い。
Sonnet 4.6から移行するコスト計算が変わった
これまで移行を慎重に進める理由の一つはトークナイザーだった。Sonnet 5にはOpus 4.7で導入された更新版トークナイザーファミリーが使われている。Anthropicのリリース発表によると、同一テキストでのトークン数倍率はコンテンツ種別により1.0〜1.35倍、Platformのドキュメントでは一般的な増加幅を約30%としている。旧計画どおり標準料金が$3/$15になっていれば、同等のプロンプトは入力で最大1Mトークンあたり$4.05、出力で$20.25となり、Sonnet 4.6の$3/$15を上回る可能性があった。
恒久料金が$2/$10となった現在は、最悪ケースでも比較が逆転する。トークン数が最大の1.35倍に膨らんでも、同じテキストに対する実質コストは入力1Mトークンあたり$2.70、出力$13.50だ。どちらもSonnet 4.6を下回る。しかもリリース時の比較表では、Sonnet 5のベンチマークスコアも高い。SWE-bench Proは63.2%対58.1%、Terminal-Bench 2.1は80.4%対67.0%、OSWorld-Verifiedは81.2%対78.5%となっている。
ただし、追っておくべき反論もある。重要なのはトークン単価ではなく、問題を1件解決するためのコストだ。eesel AIが引用したArtificial Analysisのテストでは、Intelligence IndexにおけるSonnet 5のコストは1タスクあたり約$2.29だった。プロモーション価格を除けば、高いeffortでの実行では出力料金で課金されるthinking tokensを多く消費するため、Opus 4.8より1タスクあたりのコストが高くなる可能性も示された。コミュニティの反応は率直だった。
「要するに、Sonnet 5はトークン単価は安いが、問題を1件解決するコストは高い。そして総合的な知能でもOpus 4.8にまだ届かない。」 - u/Chubby、r/accelerate
固定料金化で変わるのは計算式の前提であって、教訓そのものではない。実際の請求額は引き続きeffort設定と1タスクあたりのトークン数で決まる。能力面からSonnet 5への移行を検討するなら、Sonnet 5とSonnet 4.6の比較記事も参照してほしい。
請求額を左右するのはeffortとキャッシュ
Sonnet 5の請求額に大きく効く要素は、価格発表よりも主に2つある。1つ目はeffortだ。Sonnet 5ではlow、medium、high、xhigh、maxを選べる。リリース発表ではmedium effortでのコスト効率が大幅に改善されたとされ、リリース時の報道では、Sonnet 5のmediumはSonnet 4.6のhighとおおむね同等と整理されている。自分のワークロードで品質要件を満たせるなら、effortを1段下げられないか検証する価値がある。2つ目はプロンプトキャッシュだ。5分キャッシュの書き込みは$2.50で、後続の読み取りが1回あれば元が取れる。1時間キャッシュの書き込みは$4.00で、2回の読み取りで回収できる。その後のキャッシュ読み取りは毎回$0.20、入力料金から90%引きだ。Platformのドキュメントによれば、キャッシュとBatchの係数は重ねて適用できる。
恒久化された基本料金を前提にすると、Batch価格も見逃せない。非同期のSonnet 5処理は、1Mトークンあたり入力$1/出力$5で、結果は24時間以内に返る。この価格はHaiku 4.5の通常オンデマンド料金と同じでありながら、SWE-bench Proでは63.2%を記録するモデルを使える。相互に独立しており、レイテンシが重要でない評価実行、バックフィル、文書処理では、Batchが通常もっとも安い選択肢になる。
提供元によって異なるSonnet 5の請求額
Sonnet 5をホストする7つのプロバイダーで、料金が完全に同一というわけではない。CloudPriceのプロバイダー一覧では、Anthropic直販、Amazon Bedrock、Azure AI Foundry、Google Vertex AI、OpenRouter、Vercel AI Gatewayはいずれも$2.00/$10.00となっている。一方、Snowflakeは$2.40/$12.00で、20%の上乗せだ。また、Platformのドキュメントによれば、ベンダーを問わず注意すべき追加料金が2つある。BedrockとVertexではリージョナルまたはマルチリージョンのエンドポイントがグローバルエンドポイントより約10%高く、米国限定推論には1.1倍の係数が加わる。
| プロバイダー | 入力 / 1M | 出力 / 1M | 備考 |
|---|---|---|---|
| Anthropic API | $2.00 | $10.00 | Batchは$1/$5、全キャッシュ料金に対応 |
| Amazon Bedrock | $2.00 | $10.00 | リージョナルエンドポイントは+10% |
| Google Vertex AI | $2.00 | $10.00 | リージョナルエンドポイントは+10% |
| Azure AI Foundry | $2.00 | $10.00 | US Data Zoneデプロイメントを利用可能 |
| OpenRouter | $2.00 | $10.00 | Batchバリアントは$1/$5 |
| Vercel AI Gateway | $2.00 | $10.00 | - |
| Snowflake | $2.40 | $12.00 | 標準料金より+20% |
ディレクトリを横断して比較する際には注意したい。「$1.00/$5.00から」とSonnet 5に表示している一覧があるが、これはオンデマンド料金ではなくBatch経路の料金だ。同じ一覧でSonnet 4.6が$1.50/$7.50とされているなら、それも標準の$3/$15ではなく、Sonnet 4.6のBatch料金を指している。
恒久化した$2/$10をAPI予算にどう反映するか
これからの判断は期限対応ではなく、モデル選定の問題になる。リリース発表によれば、Sonnet 5はClaude FreeとProプランのデフォルトモデルであり、Max、Team、Enterpriseにも含まれる。サブスクリプション利用者はこのAPI料金を直接支払わない。サブスクリプションとAPIの損益分岐については、Claude API料金ガイドを参照してほしい。API購入者向けには、次のように考えるのがよい。
| 用途 | 選択 |
|---|---|
| 本番エージェント、レイテンシ重視 | Sonnet 5を$2/$10で利用し、システムプロンプトには5分キャッシュを使う |
| 夜間バックフィル、評価実行、一括処理 | Sonnet 5 Batchを$1/$5で利用 |
| 最難関のコーディングタスク(Anthropicのリリース比較表ではSWE-bench ProがOpus 4.8の69.2%に対してSonnet 5は63.2%) | Opus 4.8を$5/$25で利用 |
| 分類、ルーティング、要約 | Haiku 4.5を$1/$5で利用 |
| Sonnet 4.6を本番運用中 | 移行をパイロット導入する。Anthropicが示す1.0〜1.35倍のトークナイザー範囲でも、同等トークンあたりの料金は4.6を下回る。まず実トラフィックで品質と1タスクあたりのトークン数を検証する |
xhighやmaxでは、1Mトークンあたり$10で課金されるthinking tokensにより、問題の難度に応じて請求額が増える。Artificial Analysisは、旧$3/$15料金ではhigh effortのSonnet 5がOpus 4.8よりタスク単価で高くなり得るとした。恒久的な値下げでその下限は3分の1下がるものの、この点がなくなるわけではない。四半期予算を確定する前に、1タスクあたりのトークン数を測定しよう。本番のeffort設定で1週間分の実トラフィックをClaude API endpointに流し、1Mトークンあたりのドル単価だけでなく、ワークロード全体のコストを見積もるべきだ。
関連記事:Claude Sonnet 5 vs Sonnet 4.6 - Claude API Pricing Guide 2026 - Claude Sonnet 5 Guide