AIREITER

Gemini 3.7 Flash API料金ガイド:実測スペックとベンチマーク

最終更新日: 2026-08-13 18:50:40

Gemini 3.7 Flashは、コーディングエージェントや複数ステップのツール利用を主戦場に据えた、Flashラインで最も強力なモデルとしてGoogleが2026年8月13日に投入した。注目すべきは、DeepSWE v1.1で65.3%を記録した点だ。Gemini 3.6 Flashの49.0%から大きく伸びている。しかも導入料金は入力100万トークンあたり$0.75、出力100万トークンあたり$3.75で、3.6 Flashの標準料金のちょうど半額。ただし、この価格は2027年1月に$1.50/$7.50へ倍になると報じられており、低価格で評価できる期間はおよそ4か月となる。

Gemini 3.7 FlashのAPI料金:2026年末まで$0.75/$3.75、2027年1月から倍額

Google DeepMindのローンチ発表とコミュニティ報告、検索インデックス上の情報によると、Gemini 3.7 Flashの料金は入力100万トークンあたり$0.75、出力100万トークンあたり$3.75だ。比較対象として、Gemini 3.6 Flashの標準料金は入力$1.50/M、出力$7.50/Mとなっている(AgentPedia)。3.7 Flashの導入料金は3.6 FlashのBatch/Flexティアと同額だが、標準スループットで利用できる。

コミュニティでは、注記にある重要な条件も指摘されている。導入料金が適用されるのは2026年12月31日までで、その後は入力$1.50/M、出力$7.50/Mに戻るという。一人のRedditユーザーは、「表示されている料金の注記を見ると、4か月後に価格が2倍になる」と書いている(r/GeminiAI)。

料金ティア入力($/Mトークン)出力($/Mトークン)備考
3.7 Flash 導入料金(2026年8月〜12月)$0.75$3.75コミュニティ報告ベース。2027年1月に倍額
3.7 Flash 標準料金(2027年1月以降)$1.50$7.503.6 Flash標準料金と同額
3.6 Flash 標準$1.50$7.50現行のGA料金
3.6 Flash Batch/Flex$0.75$3.75低スループットティア
3.5 Flash-Lite 標準$0.30$2.50Gemini Flash系列で最安のティア
Gemini Flash API料金の比較チャート

出力料金にはthinkingトークンも含まれる。3.6 Flashの公開料金を基にすると、コンテキストキャッシュには標準ティアで$0.15/Mトークンが追加される(AgentPedia)。Google Search groundingとMaps groundingは別料金だ。モデルは3.6 Flashと同じ100万トークンのコンテキストウィンドウと最大64K出力を維持しているため、既存API呼び出しを壊すようなコンテキスト上限の変更はない。

ベンチマークはどこまで伸びたのか

Googleが公表したベンチマークでは、ソフトウェアエンジニアリング、コーディング、文書処理で特に改善が見られる。以下の数値は、2026年8月13日にコミュニティ投稿を通じて確認されたGoogleのローンチ発表に基づく。

ベンチマークGemini 3.7 FlashGemini 3.6 Flash差分
DeepSWE v1.165.3%49.0%+16.3ポイント
FrontierCode 1.1 Main43.6%34.4%+9.2ポイント
WebDev Arena(Elo)1,5881,538+50 Elo
GDP.pdf Document Processing34.0%22.0%+12.0ポイント
AutomationBench30.4%~17%+13ポイント
Long-Context Retrieval97%——
Gemini 3.7 Flashと3.6 Flashのベンチマーク比較チャート

最も目を引くのは、DeepSWEが49%から65.3%へ上がった点だ。相対値では+33%に当たる。DeepSWEは、複数ファイルにまたがる修正、テスト実行、コードベースの探索といったリポジトリ単位のソフトウェアエンジニアリングを測る。しかし、この数値が本番環境でも再現されるかについては、Redditコミュニティの見方が割れている。「証明されるまではベンチマーク最適化だと思っておくべき」という意見もある(r/GeminiAI)。また、比較では3.6 Flashがhigh thinkingを使っていた一方、一部の競合モデルはmediumだったため、スコアが押し上げられているとの指摘もあった。一方、巨大なコードベースから関連コードを探す必要がある開発ワークフローでは、長文コンテキスト検索の97%という結果に素直な関心が集まっている。

競合コーディングモデルと比べたコスト感

Redditの初期ユーザーは、3.7 Flashの価格性能をより安価な代替モデルとすぐに比較した。評価は一様ではない。3.7 Flashはベンチマークでは好成績だが、低価格なコーディングモデルに比べると、タスクあたりのコストはかなり高い。

ベンチマークのスレッドでは、Artificial Analysisのタスクあたりコスト基準で、Gemini 3.7 FlashはGPT-5.6 Lunaよりおよそ8倍高いと見積もるコメントがあった。Lunaのベンチマークスコアはほぼ同等にもかかわらず、という話だ。別のユーザーは、Gemini 3.7 Flashは以前、DeepSeek V4 Flashの約13倍高価だったとしている。ただしDeepSeekの料金はその後上がったという。同じコメント投稿者は、「ほぼ同じ」結果に対してLunaより「300%以上余分に」かかると端的に表現している(r/GeminiAI)。

反論もある。Lunaは幻覚を起こしやすく、DeepSeek V4 Flashの推論は「多くの間違いをする」との報告だ。ただし、これらはいずれも逸話的な評価にとどまる。

3.7 Flashが高く評価されているのは速度だ。ユーザー報告では、ほとんどの応答は3〜6秒で返る。最長だったのはクリエイティブライティングのテストで、およそ1分かかったという。複数のコメント投稿者が「猛烈に速い」と評している。

仕様、提供状況、APIアクセス方法

コミュニティで報告された仕様と3.6 Flashのドキュメントを見る限り、Gemini 3.7 Flashは3.6 Flashと同じコンテキスト上限および機能セットを維持している。

仕様値
コンテキストウィンドウ1,048,576トークン(1M)
最大出力65,536トークン(64K)
ThinkingレベルLow、Medium、High
モダリティテキスト、画像、動画、音声、PDF(入力)、テキスト(出力)
知識カットオフ2026年3月(3.6 Flash。3.7 Flashのカットオフは未確認)
キャッシュ済み入力料金$0.15/Mトークン(標準、3.6 Flashからの推定)

利用できる場所:

  • Gemini API / Google AI Studio — 開発者向けアクセス
  • Gemini app — コンシューマー向け展開
  • Gemini Spark — Google AI ProおよびGoogle AI Ultra加入者が利用可能
  • Vertex AI — 3.6 Flashと同様の提供パターンになる見込み

Googleの3.6 Flashにおける命名規則から考えると、想定されるAPIモデルIDはgemini-3.7-flashだ。デプロイ前にGoogle AI for Developers documentationで正確な文字列を確認し、gemini-flash-latestのようなエイリアスに依存せず、明示的に固定するべきだ。

3.6 Flashから移行すべきか

判断はワークロードの種類と、2027年1月の値上げをどこまで重く見るかで変わる。

移行が向くケース:コーディングエージェント、複数ステップのツール利用チェーン、文書中心の処理を動かしているなら移行を検討したい。DeepSWEの49%から65.3%への伸びは、エージェントループが初回試行で成功する割合を変えうる大きさだ。導入料金は半額なので、より低コストで評価もできる。すでに3.6 Flashを使っているチームなら、コンテキストウィンドウの前提を書き換えず、フィーチャーフラグの裏でモデルIDを差し替えられる。

待った方がよいケース:大量の分類、ルーティング、抽出が中心で、Flash-Liteが入力$0.30/M・出力$2.50/Mで十分に役割を果たしている場合だ。3.7 Flashの導入料金でも入力単価はFlash-Liteの2.5倍であり、2027年1月の倍額化で差はさらに広がる。

値上げを前提に予算を組む。現在の導入料金ではなく、2027年1月からの$1.50/$7.50を基準にすべきだ。ユニットエコノミクスが$0.75/$3.75でしか成立しないなら、このモデルは4か月後に2倍高くなる。

FAQ

Gemini 3.7 Flashの$0.75/$3.75は恒久料金ですか?

いいえ。コミュニティ報告によれば、この料金は2026年12月31日までの導入価格だ。2027年1月からは、3.6 Flashの標準料金と同じく、入力$1.50/M・出力$7.50/Mへ倍増すると報じられている。

Gemini 3.7 FlashはVertex AIで使えますか?

ローンチ時点でVertex AIでの提供は独自には確認できていない。Gemini 3.6 FlashはGA時にVertex AI経由で利用可能だったため、3.7 Flashも同様になると見込まれる。現時点のモデル一覧はGoogle Cloudコンソールで確認してほしい。

3.7 FlashはGemini 3.1 Proと比べてどうですか?

Redditユーザーによると、3.7 Flashは特定のエージェント系・コーディング系ベンチマーク、特にエージェントによる文書分析で、Proティアのモデルに匹敵するか、それを上回るという。導入料金で純粋なコーディングエージェントループを回すなら、3.7 Flashの方が価格性能はよい。一方、複雑な推論や計画ではProが依然としてより強力な選択肢だ。

thinkingトークンは別途課金されますか?

いいえ。thinkingトークンは標準の出力料金で出力トークンとして課金される。導入期間中は$3.75/Mだ。high thinkingを使うと出力コストは比例して増えるため、追加の推論が不要な大規模ワークロードではmediumまたはlowを使うとよい。