AIREITER

2026年のClaude API料金:全モデルと料金を抑える方法

最終更新日: 2026-06-30 08:51:39

Claude APIの価格は、2026年7月時点で100万トークンあたり1ドル(Haiku 4.5の入力)から100万あたり50ドル(Fable 5の出力)までとなっており、現在のすべてのモデルに共通するルールは出力トークンは入力トークンの5倍のコストがかかるということです。しかし、表示価格は簡単な部分にすぎません。新しいトークナイザー、米国限定ルーティング、高速モード、そしてほとんどの人が気づかない請求の落とし穴が、料金表と実際の請求書のあいだに存在します。しかも、同じモデルを定価の一部で購入する方法もあります。

以下の数値はすべてAnthropicの公式料金ページに記載されています。モデルの料金は変動するため、予算を確定する前に確認してください。

2026年のClaude API価格:すべてのモデル

これらは現在の100万トークンあたりの料金で、Anthropic の2026年7月の価格設定(公式ソース)と照合済みです。Opus 4.8 は2026年5月28日に 4.7 と同じ料金でリリースされました。

モデル

入力 / 1M

出力 / 1M

コンテキスト

Claude Fable 5

$10.00

$50.00

1M

Claude Opus 4.8

$5.00

$25.00

1M

Claude Opus 4.7

$5.00

$25.00

1M

Claude Opus 4.6

$5.00

$25.00

1M

Claude Sonnet 4.6

$3.00

$15.00

1M

Claude Haiku 4.5

$1.00

$5.00

200K

古いガイドの多くが誤っている点が2つあります。Anthropicで最も高性能なモデルであるFable 5は、Opusティアの上位にあり、価格は$10/$50です。一方、Opus 4.x系全体(4.6、4.7、4.8)は$5/$25のままです。この$5自体にも意味があります。Opus 4.1は$15/$75で、4.6のリリース時に$5/$25へ下がったのは、その旗艦モデルに対する67%の値下げであり、その後3回のリリースを経ても維持されています。

レガシーおよび予算向けオプション

最新モデルが必要でない場合でも、旧モデルは引き続き利用可能です: Sonnet 4.5 ($3/$15)、Opus 4.5 ($5/$25、200K context)、Haiku 3.5 ($0.80/$4)、そして最もコスト重視で大量処理向けの作業には Haiku 3 ($0.25/$1.25) です。

あまり注目されていない点ですが、Opus 4.6/4.7/4.8、Sonnet 4.6、そして Fable 5 はすべて、標準価格でフルの 100万トークンのコンテキストウィンドウを利用できます — 長文コンテキストの追加料金はありません。900Kトークンのリクエストも、9Kのリクエストと同じトークン単価で、複数の競合他社が一定の長さを超えると割増料金を課しています。

料金表に載っていないコスト

料金表は、多くの価格に関する記事がそこで終わるところであり、同時に驚きが始まるところでもあります。というのも、いくつかの要素がトークン単価を変えずに実際の請求額を動かすからです。

静かにトークンを追加するトークナイザー

Opus 4.7(および同じトークナイザーを共有する Opus 4.8)では、テキストのトークンへの分割方法が変更されました。同じ入力でも、Opus 4.6 より 最大で約35%多くのトークン が生成されることがあります — 1トークンあたりの料金は同じです。特に影響が大きいのはコード、構造化データ(JSON/XML)、および英語以外のテキストです。料金は変わらないのに、トークンの 数 が変わったためです。35%という数字を鵜呑みにしないでください。古い予算を信じる前に、新しいモデルで実際のプロンプトを token-counting endpoint にかけて再計測し、比較してください。

思考、ファストモード、および米国限定ルーティング

Anthropicの料金ドキュメントによると:

  • 拡張思考トークンは出力として課金されます。たとえそれらを一度も表示しなくても同様です。推論負荷の高いリクエストでは、静かに請求の出力側が積み上がっていきます。

  • Fast mode(Opus 4.8/4.7 のみ)は、同じモデルを最大 2.5 倍高速に実行し、標準価格の 2 倍になります。

  • US-only inference(データレジデンシー)は、入力と出力に 1.1 倍の係数を追加します。さらに、AWS Bedrock または Vertex のリージョナルエンドポイントでは、そこに約 10% が上乗せされます。

サーバーサイドツール

Anthropic側で動作するツールは、同じ料金ドキュメントに記載のとおり別料金です。web searchは1,000検索あたり$10で、結果を処理するためのトークン料金が別途かかります。code executionは月間上限までは無料で、その後はコンテナ1つあたり約$0.05/時間です。(現在の料金はpricing pageで確認してください — server-toolの料金は変更されることがあります。)

Claude Codeユーザーが陥る請求の落とし穴

これはどの価格表にも載っていません。シェルに ANTHROPIC_API_KEY を設定している場合、Claude Code はサブスクリプションではなく 従量課金の API 経由で請求します。月額固定の $20–$200 を想定していた人たちが、まさにこの理由で従量課金の請求を受けて驚かされています。長時間のセッションの前に、環境を確認してください。

Claudeはいったいいくらかかるのでしょうか?

料金は、ワークロードに当てはめるまであまり意味を持ちません。現在の価格での3つの例を、いずれも1日10,000リクエスト(各2,000入力 + 500出力トークン — 1日あたり2,000万入力 + 500万出力トークン)で示します:

  • Haiku 4.5 上のサポートチャットボット($1/$5):20M × $1 + 5M × $5 = $45/day、約 $1,350/month。

  • Sonnet 4.6 上のコーディングエージェント($3/$15):$60 + $75 = $135/day、最適化前では約 $4,050/month。

  • Opus 4.8 上の高コンテキスト RAG アプリ($5/$25)では、取得したドキュメントによって input が大幅に増えるため、input volume が支配的になり、月額は高額な4桁後半から5桁台に達します。

同じ容量でも、3つのモデルがあり、モデルの選択だけで Haiku と Sonnet の間で請求額が約3倍変わります。

これらは仮定上の上限ではありません。ある r/ClaudeAI のスレッドでは、Claude Code の31人のユーザーの利用状況が追跡され、その利用額は API レートで月額およそ80,000ドルに相当し、最多ユーザーだけで約18,000ドルに達していました。これは、サブスクリプション利用が従量課金のAPIで請求されるならどうなるかという推定であり、実際の請求書ではありません。大規模な自律ワークロードこそが請求額を現実のものにする場面であり、まさにその領域で以下の最適化が効果を発揮します。

レート制限と使用ティア

価格だけが制約ではありません — 使える速度にも段階があります。 新しいAPIアカウントは、控えめなリクエスト数/分(RPM)とトークン数/分(TPM)の上限から始まり、アカウントの経過期間と累計支出が増えるにつれて自動的に上昇します(Tier 1 → 4)。新規アカウントには、カード不要で試せる$5分の無料クレジットも付与されます。スループット以外にも、Anthropicは可用性と価格のトレードオフとなるサービスティアを提供しています。標準ティア(デフォルト)、可用性を保証する優先ティア、そして下記の50%非同期割引が適用されるバッチティアです。スケールを見据えて設計する前に、あなたのティアの正確な数値についてrate-limits docsを確認してください — 試験運用のトラフィックには十分でも、本番ではティア引き上げが必要になる場合があります。

Claudeサブスクリプション vs API: どちらが安いですか?

最も一般的な現実世界の質問であり、その答えは判断ではなく、しきい値です。

  • Claude Pro は月額 $20 です。Max は月額 $100 または $200 です。これらには、利用枠の範囲内で Claude アプリと Claude Code が含まれます。トークンごとの課金はありません。

  • The API は完全な従量課金制で、月額最低料金はなく、利用上限もありません。

分岐点は月あたり数百万トークン台前半です — 中位モデル(Sonnet)でおおむね 300万〜400万、入力と出力の比率が均衡しており、通常なら Pro の利用枠内に収まることを前提としています。Haiku では上がり、Opus では下がるため、固定値ではなく範囲として捉えてください。この量を下回るなら、通常はサブスクリプションのほうが安くてシンプルです。これを超えると、特に本番トラフィックや大量の agentic coding では、API のトークン単価のほうが有利になり、プランでは得られない制御(rate limits、monitoring、multi-key billing)も利用できます。特に終日コーディング用途では、開発者の見積もりによると、Max plan は Opus をトークン単位で課金した場合の同じ作業より大幅に安くなる可能性があります。

実用的なルールは、プロトタイプや個人利用なら → サブスクリプション;スケールしたプロダクトのトラフィックなら → API です。そして、上の ANTHROPIC_API_KEY の落とし穴に注意してください。さもないと、両方の方法で支払うことになります。

Claude APIの料金を抑える方法

3つの施策で、モデルを変えずに標準料金を削減できます。

1. プロンプトキャッシング(繰り返しコンテキストを最大90%オフ)

安定したプレフィックス — 長いシステムプロンプト、取得したドキュメント、few-shot の例 — をキャッシュすると、キャッシュ読み取りは入力レートの0.1倍のコストとなり、90%の割引になります。注意点は書き込みです。5分キャッシュの書き込みは1.25倍のコストで、1回の読み取りで元が取れます。1時間キャッシュの書き込みは2倍のコストで、2回の読み取りで回収できます。大きな固定プレアンブルを何度も使うものにとって、これは単独で最も大きなレバーです。(Caching docs。)

2. バッチ API(50%オフ、両方向)

リアルタイムの応答を必要としない用途では、Batch API は入力と出力を50%割引し、24時間以内に結果を返します。Sonnet 4.6 は $1.50/$7.50 に、Haiku 4.5 は $0.50/$2.50 に下がります。キャッシングとバッチ処理は併用でき、実効コストは表示料金の半分を大きく下回ります。

3. モデルルーティングと出力上限

すべてのリクエストをOpusで実行しないでください。分類、要約、ルーティングロジックはHaikuに振り分け、中間の処理にはSonnetを使い、タスクに必要な場合にのみOpusを呼び出します。これだけで、通常は単体で40〜60%の削減になります。また、出力は入力の5倍の価格であるため、capping max_tokensは最も効果の高い設定の1つです。100万回の呼び出し全体で平均出力を800トークンから500トークンに削減すれば、毎月かなりのコスト削減になります。

公式 API と中継プラットフォーム:より安く支払えるのか?

公式ドキュメントには載っていない4つ目の方法があります。それは、リレーを通じて同じ Claude モデルを購入することです。API リレー(またはアグリゲーター)は、あなたと Anthropic の間に位置し、Anthropic 互換のエンドポイントを公開し、独自の料金を請求します。

なぜリレーの方が安くなり得るのか? 主な理由は3つあります。リレーは、個別アカウントでは到達できない割引が得られるコミット利用量で購入していること、地域やプロバイダーをまたいで効率的にルーティングしていること、そして開発者を獲得するために薄い利益率(あるいは利益度外視)で運営していることです。ですが、これほど大きな割引はどこかから出ている必要があります。依存する前に、そのプラットフォームのビジネスモデルを理解してください。

割引は大きく異なります。以下は、同じClaudeモデルに対する3つのオプションの比較です:

プラットフォーム

Anthropic定価比の割引

モデル対応範囲

備考

Official Anthropic API

— (baseline)

All, incl. Fable 5 / Opus 4.8

Caching, batch, every feature

OpenRouter

≈ list (passes provider price through)

Many models, multi-provider

Aggregator; convenience over savings

EvoLink

~10% off

Up to Opus 4.7

OpenAI-compatible endpoint

AIReiter

~80% off

Up to Opus 4.6

Anthropic-compatible; caching passes through

AIReiterは攻撃的な側に位置しています。各モデルごとの見出しの約80%は次のようになります:

モデル

公式(入力 / 出力)

AIReiter(入力 / 出力)

あなたの節約額

Claude Haiku 4.5

$1 / $5

$0.20 / $1.00

80%

Claude Sonnet 4.6

$3 / $15

$0.60 / $3.00

80%

Claude Opus 4.6

$5 / $25

$1.00 / $5.00

80%

統合はドロップインで、AIReiter のエンドポイントは Anthropic Messages API と互換性があります。そのため、公式の anthropic SDK は 2 行を変更するだけで動作します — base_url を https://aireiter.com/api に向け、キーを差し替えてください:

client = anthropic.Anthropic(
    api_key="YOUR_AIREITER_KEY",
    base_url="https://aireiter.com/api",
)

ストリーミング、マルチターン、ビジョン、および cache_control はすべてそのまま通過するため、上記の90%のキャッシュ割引は、より低い基本料金にさらに重なって適用されます。

よくある質問

なぜ Claude API はそんなに高いのですか?

多くの場合、問題はトークン単価ではなくワークフロー設計です。最大のコスト要因は、Haiku や Sonnet で十分な場面でもすべてを Opus で実行していること、キャッシュされない繰り返しのコンテキスト、上限なしの出力、そして請求はされるのに目に見えない reasoning tokens です。これらを修正することのほうが、たいていは表面上の価格よりも重要です。

Claude API の無料プランはありますか?

恒久的な無料の本番利用枠はありませんが、新しいアカウントにはテスト用として$5分の無料クレジット(カード不要)が付与されます。その後は従量課金制です。

Claude API と ChatGPT の価格比較 — どちらが安いですか?

比較するティアによって異なります。概ね、100万トークンあたり(入力 / 出力)は次のとおりです:

Claude

比較可能な OpenAI

Haiku 4.5 — $1 / $5

GPT mini tier — 数ドル台前半

Sonnet 4.6 — $3 / $15

中位 tier — 同等

Opus 4.8 — $5 / $25

GPT-5.5 — 約 $5 / $30

毎月のClaude API請求額はどのように計算しますか?

次のように見積もります: (requests × avg input tokens ÷ 1,000,000 × input rate) + (requests × avg output tokens ÷ 1,000,000 × output rate)。実際のプロンプトで正確なカウントを行うには、token-counting endpointを使用してください。汎用の tokenizer は、Claude では 15〜35% ずれることがあります。

要するに

ほとんどのチームでは、次の3つに分かれます。プロトタイピングまたは個人利用 → Pro または Max のサブスクリプション(よりシンプルで、月間 ~3–4M tokens 未満なら安価); 最新フラッグシップでの本番運用(Opus 4.8、Fable 5)→ キャッシュ、バッチ処理、ルーティングを有効にした公式 API; Sonnet 4.6 または Opus 4.6 で十分な本番運用 → AIReiter のような信頼できる relay を使えば、SDK を差し替えるだけで同じ請求額を最大 80% 削減できます。

どちらを選んでも、ほとんどのチームは誤ったティアを選ぶことでではなく、最適化を省くことで過払いしています。そのため、料金表を気にする前に、まず各種設定を有効にしましょう。