GPT-5.6 Lunaは80%減、Terraは20%減。OpenAIが価格改定を実施したのは2026年7月30日だ。もっとも、Solの標準料金は据え置きであり、マルチターンのエージェントを運用している場合は、キャッシュ書き込みの課金によって値下げ分の大半が請求額に反映されないこともある。
2026年7月30日の価格改定で変わったこと
値下げは2026年7月30日に発効し、既存のモデルIDにそのまま適用される。OpenAIは、提供基盤の効率を改善したことを受けて2モデルを値下げしたと説明している。一方、GPT-5.6 Solの標準料金に変更はない。
| モデル | モデルID | 改定前の入力 | 現在の入力 | 改定前の出力 | 現在の出力 |
|---|---|---|---|---|---|
| GPT-5.6 Luna | gpt-5.6-luna | $1.00 | $0.20 | $6.00 | $1.20 |
| GPT-5.6 Terra | gpt-5.6-terra | $2.50 | $2.00 | $15.00 | $12.00 |
| GPT-5.6 Sol | gpt-5.6-sol | $5.00 | $5.00 | $30.00 | $30.00 |
料金はいずれも100万トークンあたり。標準ティア、短いコンテキストでの価格であり、OpenAI APIの料金ドキュメントを2026-07-31に確認した。
「GPT-5.6シリーズが安くなった」という言い方は、3分の2だけ正しい。同じタイミングでOpenAIはSol向けにFast modeを追加した。入力$10.00、出力$60.00と標準料金の2倍だが、基盤モデルを変えずに最大2.5×のスループットを提供する。料金ドキュメントによると、Fast modeは従来priority processingと呼ばれていた機能だ。つまり下位2ティアが値下げされる一方、最上位ティアには高価な選択肢も加わった。
モデル指定ではシリーズ名だけでなく、明示的なモデルIDを使いたい。OpenAIのモデルカタログでは、gpt-5.6はgpt-5.6-solのエイリアスとなっている。安価なティアを想定して短縮名でルーティングすると、最上位料金で請求される。リセラーではこのエイリアス自体を扱っていない場合もある。AIReiterのエンドポイントでは、gpt-5.6はModel 'gpt-5.6' not foundを返した(2026-07-31にテスト)。
開発者の反応では、値下げ幅そのものよりも、その価格が持続するのかに関心が集まっている。
OpenAIの5.6モデルが本当にそんな低コストで動かせるはずがない — r/Anthropicのスレッドタイトル
LunaがGPT-5.4 nanoより安くなった今、どのティアを選ぶべきか
GPT-5.6 Lunaは入力$0.20、出力$1.20となり、出力トークン単価ではgpt-5.4-nano($0.20 / $1.25)を下回った。gpt-5.4-mini($0.75 / $4.50)と比べても大幅に安い。コストだけを理由に旧nanoやminiを残していたなら、その根拠はなくなった。
この低価格ティアが実務で通用するかを見るため、2026-07-31にAIReiterのOpenAI互換エンドポイント経由で、GPT-5.6の3モデルに2種類のタスクを実行した。厳格なスキーマを使うサポートチケットからJSONへの抽出と、正答が$23.71に定まるトークン課金の計算問題だ。各モデルで各タスクを2回実行し、max_tokens: 4000、リトライなし。期待する出力に対する合否で判定した。
| タスク | モデル | 入力トークン | 出力トークン | レイテンシ(1回目 / 2回目) | 正解 |
|---|---|---|---|---|---|
| チケット → JSON | Luna | 135 | 77–78 | 4.0秒 / 3.5秒 | はい |
| Terra | 135 | 46 | 2.1秒 / 2.1秒 | はい | |
| Sol | 135 | 46 | 2.3秒 / 2.2秒 | はい | |
| 課金計算 | Luna | 119 | 111–122 | 3.1秒 / 4.3秒 | はい |
| Terra | 119 | 87–89 | 3.8秒 / 2.8秒 | はい | |
| Sol | 4,488 | 84–87 | 3.5秒 / 3.2秒 | はい |
この結果から、特に取り上げるべき点は2つある。
抽出タスクで最も遅かったのはLunaだった。 最速ではなく、Terraの2.1秒に対して3.5~4.0秒を要した。安価なティアが自動的に低レイテンシとは限らない。
TerraとLunaが119トークンと数えたプロンプトに対して、Solは入力4,488トークンを報告した。 このうち3,840トークンにはcached_tokensのフラグが付いていた。2回の実行で完全に再現している。一方、単純なプロンプト(「OKという単語だけで返答してください。」)では、3モデルとも24トークンで一致した。したがって膨張はモデルではなくプロンプトに追随している。トークン数は確認できても原因は分からない。これはモデルの文書化された性質ではなく、1つのエンドポイントで観測した課金挙動として扱うべきだ。
公式の標準料金で換算すると、同一の正答にかかったコストは次の通りだった。
1,000回あたり、Lunaは$0.16、Terraは$1.29、Solは$7.73だった。同じ3桁の数値を返すために、SolはTerraのおよそ6倍、Lunaのおよそ47倍を請求したことになる。
これは簡単な2タスクを各2回試した小規模なサンプルであり、ベンチマークでも推論品質の測定でもない。ただし、実運用ではまずLunaから始め、自分のトラフィックで計測した失敗時だけ上位へ切り替える、という原則は支持する。この試行では、Terraがすでに正答している場面でSolに支払っても得るものはなかった。ワークロード別の使い分けは末尾の表にまとめている。
80%値下げでも請求額が80%下がるとは限らない理由
見出しの料金は、新規入力トークンと出力トークンに対するものだ。マルチターンのエージェントトラフィックでは、第3のコストであるキャッシュ書き込みが支配的になることがある。GPT-5.6の全3ティアで、キャッシュ書き込みはキャッシュ読み取りの12.5倍の価格だ。
| モデル | キャッシュ済み入力(読み取り) | キャッシュ書き込み | 比率 |
|---|---|---|---|
| GPT-5.6 Luna | $0.02 | $0.25 | 12.5× |
| GPT-5.6 Terra | $0.20 | $2.50 | 12.5× |
| GPT-5.6 Sol | $0.50 | $6.25 | 12.5× |
この差がどれほど効くかは、2026-07-11にOpenAI開発者コミュニティへ投稿された統制テストがよく示している。previous_response_idで連結したResponses APIの連続6ターンで、Lunaはgpt-5.4-miniより入力トークンが3%少なく、出力トークンも29%少なかった。それでも会話あたりのコストは96%高かった($0.0332に対して$0.0651)。Lunaの入力の約70%がキャッシュ書き込みとして課金されていたためだ。数値は値下げ前のものだが、仕組みは変わっていない。
重要なのは、その実装では原因を修正できた点だ。GPT-5.6のキャッシュは部分一致を評価しないため、キャッシュ済みプレフィックスが少しでも変わると全体を書き直す必要がある。投稿者は、増え続ける会話スナップショットをinstructions内で再構築しており、ターンごとにプレフィックスを無効化していた。
診断結果は明確だった。固定したinstructionsでは以後のユーザーターン15回中15回でキャッシュがヒットし、可変のinstructionsでは15回中0回だった。コンテキストをdeveloper input itemへ移すと、Lunaの割高分は96%から16.7%へ低下した。その後のLunaは投稿者のブラインドレビューでminiより高速かつ高得点だった。prompt_cache_keyも明示的なキャッシュブレークポイントも効果はなかった。
値下げが実際に自分の請求額へ届いているかを判断する前に、次の2点を確認したい。
- 可変データをキャッシュ済みプレフィックスに混ぜない。 システムテキスト、ツール定義、ペルソナは先頭に置き、バイト単位で同一に保つ。会話状態はinput itemsに入れる。
- APIレスポンスから内訳を確認する。 呼び出しごとに
usage.prompt_tokens_details.cached_tokensとusage.prompt_tokensを比べれば、読み取りの比率が分かる。長時間動作するエージェントでこの比率が低いなら、このシリーズでは最も影響の大きいコストバグだ。
GPT-5.6の価格が3通りに見える理由
GPT-5.6 Lunaの価格を検索すると、少なくとも3種類の数字が見つかる。それぞれは、特定のティアについては現在または過去に正しい数字だ。どのティアの価格かを確認すれば、矛盾の大半は解消する。
| 見かけた価格 | Lunaの入力 / 出力 | 内容 |
|---|---|---|
| $0.20 / $1.20 | 標準ティア、短いコンテキスト | 通常のAPI呼び出しにおけるデフォルト |
| $0.10 / $0.60 | BatchおよびFlexティア | 非同期・低優先度ワークロード向けの標準料金半額 |
| $0.40 / $2.40 | Fast mode | 標準料金の2倍 |
| $1.00 / $6.00 | 7月30日以前の標準料金 | 値下げまでは正しい価格 |
同じ料金ドキュメントには、さらに2つの調整要素がある。長いコンテキストでは短いコンテキストの入力料金が2倍、出力料金が1.5倍となる。Lunaの長文コンテキスト料金は$0.40 / $1.80であり、$0.40 / $2.40ではない。また、2026-03-05以降にリリースされたモデルを対象とするデータレジデンシー対応エンドポイントでは、対象条件を満たす場合に10%の上乗せが記載されている。GPT-5.6はすべてこれに該当する。
料金ページと請求書の数字が食い違う場合、確認すべきことは2つだ。まずページ上の確認日を探す。次に、実際に呼び出しているティアについて、公式の料金ドキュメントと照合する。アグリゲーターやリセラーは独自料金を掲載していることもあり、これはさらに別のカテゴリーだ。古い情報なのではなく、単に別価格である。
AIReiterでは、GPT-5.6の3ティアはいずれもOpenAIのリスト価格の50%に設定されており、7月30日の値下げにも連動した。GPT-5.6 Lunaは$0.10 / $0.60、Terraは$1.00 / $6.00、Solは$2.50 / $15.00で、キャッシュ済み入力とキャッシュ書き込みにも同じ半額設定が適用される。
たとえばTerraのエージェントで、1日あたり入力100万トークン、出力20万トークンを処理するなら、リスト価格では1日$4.40、AIReiterでは$2.20となる。同じ呼び出し、同じモデルIDでの比較だ。
市場全体でLunaがどこに位置するかは別の問題である。VentureBeatが7月30日に比較した30モデルでは、Lunaの合計料金$1.40はGemini 3.5 Flash-Lite($2.80)およびGemini 3.1 Flash-Lite($1.75)を下回るが、DeepSeek v4-flash($0.42)より高い。コストだけが基準なら、最も安いLLM APIはOpenAI製ではない。
FAQ
GPT-5.6 Solも値下げされた?
いいえ。Solの標準料金は100万トークンあたり入力$5.00、出力$30.00で変わっていない。料金を2倍にして最大2.5×のスループットを提供するFast modeが追加された。
GPT-5.6 Lunaは最安のAPIモデルになった?
いいえ。100万トークンあたり合計$1.40で、フロンティアシリーズのモデルとしては低価格帯に入る。ただしVentureBeatの7月30日の表では、DeepSeek v4-flash($0.42)、XiaomiのMiMo-V2.5 Flash($0.40)、DeepSeek v4-pro($1.305)がこれを下回っている。
GPT-5.6 Lunaが$1 / $6と表示されているページがあるのはなぜ?
それは2026年7月30日以前の標準料金だ。ページに記載された確認日をチェックし、実際に呼び出すティアについて公式料金ドキュメントで確認してほしい。
値下げはBatchとFlexにも適用される?
はい。BatchとFlexは標準料金の半額に設定されているため、これらのティアでLunaは$0.10 / $0.60、Terraは$1.00 / $6.00となる。キャッシュ済み入力とキャッシュ書き込みも対象だ。
新料金を適用するためにコード変更は必要?
不要だ。既存のgpt-5.6-lunaおよびgpt-5.6-terraのモデルIDに、移行なしで値下げが適用される。変更する価値があるのはキャッシュ読み取り比率の監査であり、値下げが最も失われやすいのはこの部分だ。
ワークロード別:GPT-5.6の推奨ティア
| ワークロード | ティア | 理由 |
|---|---|---|
| 大量の抽出、タグ付け、要約 | Luna | 両テストタスクに合格。100万トークンあたり合計$1.40で、gpt-5.4-nanoを下回る |
| レイテンシが重要なユーザー向け呼び出し | Terra | 抽出タスクではLunaより高速だった(2.1秒対3.5~4.0秒) |
| Lunaが品質基準を満たさない場合の最初のエスカレーション先 | Terra | 合計$14。Solの$35より低い |
| 自分のトラフィックでTerraの性能不足が計測できたタスク | Sol | Terraの実測タスク単価の6倍を支払う根拠はこれだけ |
| すべてのティアにおけるマルチターンエージェント | まずキャッシュを修正 | キャッシュ書き込みは読み取りの12.5倍。プレフィックス設計が悪ければティア選択を上回る |