AIREITER

Cursor 中的 Gemini 3.8 Flash:上下文、費用與設定

最近更新: 2026-09-03 04:19:25

如果你的工作涉及多個檔案、頻繁使用工具,Gemini 3.8 Flash 值得在 Cursor 中實際測試。不過,Cursor 預設只有 200K 上下文、採用依方案計費,而且預設使用 High 思考程度;因此,Google 的 API 規格並不能代表你在 Cursor 裡真正得到的體驗。

先講結論:工具密集型開發可優先試用 Gemini 3.8 Flash

當 coding agent 必須檢查多個檔案、執行指令、處理錯誤,並完成一項實際修改,而不只是產生幾行程式碼時,Gemini 3.8 Flash 很值得在 Cursor 中測試。至於短篇補全,或目前使用 Gemini 3.7 Flash 已經穩定、而且流量很大的工作,升級的吸引力就沒那麼高。

建議先從範圍明確的任務開始,使用一般上下文與 Cursor 提供的思考程度設定。先追蹤實際採用的修改、工具呼叫回合、重試次數與總用量,再決定是否要把它設為整個團隊的預設模型。

使用情境建議起點
新增具備測試的多檔案功能Gemini 3.8 Flash,Medium
困難的重構或冗長的工具鏈Gemini 3.8 Flash,High
小幅修改或說明Low,或已經驗證過的快速模型
現有的高效率 3.7 工作流程先進行 A/B 測試再切換

Cursor 實際提供了什麼

Google 將 Gemini 3.8 Flash 列為穩定模型,模型 ID 是 gemini-3.8-flash。Google 於 September 2, 2026 宣布這個模型,定位是長時間軟體工程任務、自主代理程式,以及複雜的企業工作流程;模型卡則表示它是以 Gemini 3.7 Flash 為基礎(Google 的發布公告、Google 的模型卡)。

Google 的規格描述的是模型本身;你在編輯器中實際能用到的功能,則取決於 Cursor 的設定:

項目Google 文件Cursor 列出的整合規格
模型 IDgemini-3.8-flashgemini-3.8-flash
輸入上限1,048,576 tokens預設 200K,列出的最高上限為 1M
輸入類型文字、圖片、影片、音訊與 PDF取決於 Cursor 的 agent 與檔案工作流程
輸出文字,最高 65,536 tokenscoding agent 中的文字輸出
思考程度Low、medium、high列出的預設值為 High,也提供較低程度
工具函式呼叫、程式碼執行、檔案搜尋、URL context、Search 與 Maps grounding,以及 Preview 中的電腦操作檔案搜尋、編輯、Shell 指令、網頁、瀏覽器、螢幕截圖,以及其他 Cursor agent 工具
Cursor 的 Gemini 3.8 Flash 模型文件

Google 的 API 模型頁面確認了 1,048,576 tokens 的輸入上限、65,536 tokens 的輸出上限、多模態輸入,以及僅限文字的輸出。至於編輯器真正開放哪些功能,Cursor 自己的模型頁面才是較可靠的參考。

Cursor 的存取與定價:先確認你用的是哪個方案

Cursor 將 Gemini 3.8 Flash 視為第三方模型,使用量會從 Other Models 用量池扣除,而不是從 Composer、Grok 等 Cursor 自有模型所使用的 Cursor Models 用量池扣除。Pro、Pro Plus 與 Ultra 都包含 Other Models 用量池;僅限印度的 Start 方案則不包含(Cursor Models & Pricing)。

Cursor 方案列出價格Gemini 3.8 Flash 存取權
Start,僅限印度₹649/月,含稅不包含;此方案涵蓋的是 Cursor Models
Pro$20/月包含 Other Models 用量池
Pro Plus$60/月包含 Other Models 用量池
Ultra$200/月包含 Other Models 用量池

Cursor 專屬的 Gemini 3.8 Flash 頁面列出的每百萬 tokens 費率如下:

費用項目Cursor 列出的費率
輸入$0.75
快取輸入$0.075
輸出$3.50

這些是 Cursor 整合服務列出的費率,不是 Google 直接 API 的價目表。Google 列出的價格是每百萬輸入 tokens $0.75、每百萬輸出 tokens $3.75,適用至 December 31, 2026;自 January 1, 2027 起,標準費率將變為 $1.50 與 $7.50(Google Cloud pricing)。輸出費用相差 15 美分,代表的是不同路由的計費差異,因此不要把 Cursor 的估算金額和 Google 帳單混在一起比較。

對於 Teams 與 Enterprise 方案,Cursor 另外說明,第三方模型請求採用每百萬 tokens $0.25 的 Cursor Token Rate(Cursor Models & Pricing)。包含的用量用完後,隨用隨付會按照列出的模型費率繼續計算。Cursor 表示,請求不會因此被降低品質或速度。

如果你是透過 Cursor 內建的模型選擇器使用 Gemini 3.8 Flash,通常不需要提供 Google API key。只有在 Google AI Studio 或 Gemini API 中直接呼叫 gemini-3.8-flash 時,Google key 才會派上用場;Cursor 的計費與模型文件說明的是它自己的連線方式與用量計算。

Cursor 的上下文:預設 200K,只有在介面開放時才能用到 1M

Google 文件寫明最大輸入上下文為 1,048,576 tokens;Cursor 則將 Gemini 3.8 Flash 列為預設 200K、最高 1M(Cursor 的模型頁面)。

Cursor 的定價文件指出,Max Mode 僅適用於舊版的 request-based 方案,可讓模型超出預設上下文上限,並按照模型 API 費率加收 20%。因此,模型支援 1M 上下文,不代表每個帳戶都能在 Cursor 發出 1M 的請求。

可以這樣理解這些限制:

  • 200K 已經夠用:適合範圍明確的功能、錯誤修正,或中小型儲存庫的一部分。
  • 較大的上下文會派上用場:當 agent 必須串連許多套件、閱讀冗長規格、產生的檔案,或大量文件時。
  • Max Mode 值得測試:先確認你的方案是否提供這項功能,以及少幾次重試是否足以抵銷 20% 的附加費。
  • 視窗變大不等於完美記憶:能放入更多輸入,不代表 agent 就一定能正確使用每一項指示。

第一次使用時,建議先明確指出相關目錄,只有在任務確實需要時才加入其他檔案。

思考程度怎麼選:讓推理強度配合工作難度

Gemini 3.8 Flash 支援 low、medium 與 high 三種思考程度。Google 不支援 minimal;如果使用這個程度發出請求,會收到錯誤(Google 的遷移文件)。

思考程度適合用途主要取捨
Low說明、小幅修改、格式整理、簡單測試推理額外負擔較低
Medium一般除錯、功能開發與大多數 agent 任務品質與延遲取得平衡
High架構調整、棘手錯誤、大型重構與冗長工具鏈需要更多推理與 tokens,也可能增加等待時間

預設值會因使用介面而異。Google 的 API 文件將 Medium 描述為預設值,但 Cursor 的專屬模型頁面則列出 High 為預設值。實際執行請求時,應以產品介面顯示的控制項為準。

Google 表示,Gemini 3.8 Flash 在面對困難任務時可能會「更努力工作」:增加推理步驟、反覆呼叫工具,並驗證中間結果。Google 的定價表會將回應與推理 tokens 都算入輸出,因此即使輸入與輸出的單價沒有變,High 思考程度仍可能讓任務成本上升(Google Cloud pricing)。

在 Cursor 中,簡單任務從 Low 開始;一般實作使用 Medium;只有在能明確說明更深入規劃有助於改善結果時,才升到 High。

讓 Gemini 3.8 Flash 在 Cursor 發揮作用的工作流程

Gemini 3.8 Flash 在 Cursor 中最適合用來處理目標清楚、而且有明確驗證方式的任務。

先把任務範圍畫清楚

告訴 agent 你要的結果、允許修改的目錄或檔案、用來確認修改有效的指令,以及何時應該停止。

檢查 src/auth/ 中的驗證 middleware,以及 tests/auth/ 裡失敗的測試。找出 401 回歸問題最小範圍的原因,進行最小且安全的修正,執行針對性的測試指令;如果修正需要變更 schema,就停止。

這樣既保留檢查與編輯所需的空間,也不會讓大範圍重寫整個儲存庫變成「完成任務」的標準。

讓 agent 使用工具,但要求它驗證結果

Cursor 的文件指出,Gemini 3.8 Flash 可透過 agent 使用檔案搜尋、讀取檔案、編輯、Shell 指令、網頁工具、瀏覽器控制與螢幕截圖。接受修改前,要求它說明根本原因、修改過的檔案、完整測試指令、執行結果,以及仍然存在的不確定性。

同時設定最大回合數。更多工具呼叫不一定能帶來更好的結果;一位開發者曾分享,在早期的實測報告中,為了一項簡單的四行修改,等了超過 100 次工具呼叫(X 上的 theo)。

用每次採用的修改控制成本

記錄 Cursor 方案、思考程度、上下文模式、編輯器顯示的用量、工具回合、重試次數、完成時間,以及最後的差異檔是否通過檢查。真正有用的指標是每次採用修改的成本,而不是每次請求的成本。

Cursor 中的 Gemini 3.8 Flash,與 Google API 有何不同

應該根據需要的工作流程選擇使用途徑。Cursor 提供編輯器、儲存庫工具、方案控制與自己的用量計算;Google 則提供直接 API 介面與 Google 自己的價目表。

考量點CursorGoogle Gemini API
存取方式在 Cursor 的 Chat 或 Agent 介面選取模型使用 Google API key 與 gemini-3.8-flash
文件列出的計費每 1M tokens:輸入 $0.75、快取輸入 $0.075、輸出 $3.50每 1M tokens:輸入 $0.75、快取輸入 $0.075、輸出 $3.75,適用至 2026 年
上下文呈現方式預設 200K、列出的最高上限為 1M;Max Mode 取決於方案最高 1,048,576 個輸入 tokens
思考程度預設值Cursor 列出 HighGoogle 文件列出 Medium
工具環境Cursor 的檔案、Shell、網頁、瀏覽器與編輯器工作流程Google 的函式呼叫、程式碼執行、grounding、URL context,以及 Preview 中的電腦操作等工具
最適合的用途在編輯器內進行儲存庫開發應用程式、服務、agent 與自訂協調流程

如果你要直接實作 API,Gemini 3.8 Flash API pricing review整理了預定於 January 1, 2027 生效的價格變更,以及更完整的 token 成本計算。評估 Cursor 與直接 API 時,應分開計算,因為兩者的工具環境、預設值與計費層都不同。

從 Gemini 3.7 Flash 遷移的檢查清單與 30 分鐘試行

在 Cursor 裡切換模型選擇器,和遷移 API 並不是同一件事。保留原有規則與提示詞,然後在相同的儲存庫狀態下比較兩個模型。

  1. 挑選 10 個具代表性的 Cursor 任務,包括錯誤修正、多檔案功能、重構、測試修復,以及文件或設定變更。
  2. 5 個任務使用 Medium,另外 5 個使用 Low;High 保留給其中最困難的兩個任務。
  3. 先使用一般上下文;如果你的方案支援延伸上下文,再用一個較長的任務重跑一次。
  4. 記錄採用的修改、失敗的測試、重試次數、工具回合、完成時間與用量。
  5. 先讓 Gemini 3.8 Flash 在一類任務上進行金絲雀測試;只有當它每次產出可接受結果的成本低於 Gemini 3.7 Flash 或目前使用的模型時,才將它設為預設模型。

如果你正在修改直接呼叫 Google API 的程式碼,請參考 Google 提供的遷移文件,了解 thinking_level、不支援的參數,以及更嚴格的回合格式要求。不要假設這些直接 API 的限制,會一對一套用到 Cursor 的 adapter。

Gemini 3.8 Flash 在 Cursor 中的常見問題

在 Cursor 使用 Gemini 3.8 Flash,需要 Google API key 嗎?

通常不需要。Cursor 透過自己的第三方整合與用量池提供這個模型;Google API key 是直接使用 Google API 或 AI Studio 時才需要。

為什麼 Cursor 的上下文與思考程度設定和 Google 不一樣?

Cursor 將預設上下文列為 200K、最高 1M,預設思考程度列為 High;Google 則記載 1,048,576 個輸入 tokens,並將 Medium 設為 API 預設值。實際可用的上下文與思考程度,取決於使用的產品介面與方案。

Gemini 3.8 Flash 包含在 Cursor Pro 中嗎?它是免費的嗎?

Cursor 表示 Pro、Pro Plus 與 Ultra 都包含 Other Models 用量池,但這個模型仍按用量計費;僅限印度的 Start 方案不包含該用量池。

Gemini 3.8 Flash 能產生圖片或音訊嗎?

目前沒有文件記載它支援這類原生輸出:Gemini 3.8 Flash 可接受文字、圖片、影片、音訊與 PDF 輸入,但輸出內容為文字。

Max Mode 一定能提供 1M 上下文嗎?

不一定。Cursor 表示 Max Mode 僅限舊版 request-based 方案,並會在模型 API 費率之外加收 20%。