2026 年最佳免費 AI API:官方額度與資料政策完整比較

最近更新: 2026-07-29 10:05:34

2026 年,免費 AI API 還能撐起真正的專案嗎?答案是可以。光是 Groq 的 8B Llama 模型,每天就提供 14,400 次免費請求。不過,各家額度差距可達三個數量級,而且 Google 已不再公開列出免費層的具體數字。以下所有資料均來自供應商官方文件,查核日期為 2026 年 7 月 29 日。

免費 AI API 額度總覽:2026 年 7 月 29 日官方核實

以下九家供應商都能在不綁定信用卡的情況下取得 API 金鑰。其中七家提供可持續使用的免費層;NVIDIA 與 Hugging Face 則是一次性、用完即止的額度。

供應商免費方案(官方數字)信用卡免費方案是否拿資料訓練
Google Gemini APIflash/pro 文字模型可免費使用 Token;各模型 RPM/RPD 僅會顯示於你的 AI Studio 帳戶內不需要(「Used to improve our products: Yes」)
Groqllama-3.1-8b:30 RPM / 14,400 RPD;llama-3.3-70b:30 RPM / 1,000 RPD / 100K TPD不需要預設不保留資料;可申請 ZDR
OpenRouter:free 模型:20 RPM、每天 50 次;一次儲值 $10 後可提升至每天 1,000 次不需要(儲值非必要)取決於上游供應商;可用開關選擇退出
GitHub Models低階模型:15 RPM / 150 RPD;DeepSeek-R1:1 RPM / 8 RPD不需要(僅需 PAT)文件未說明
Cloudflare Workers AI每天 10,000 Neurons,於 00:00 UTC 重置不需要不會(有明確承諾)
Cohere試用金鑰:20 req/min、每月 1,000 次呼叫不需要速率限制頁面未說明
Mistral提供免費模式;限制僅顯示於你的 Admin Panel不需要未說明;已宣布提供免費零保留選項
Hugging Face Inference Providers每月 $0.10 額度(標示為「subject to change」)不需要依實際路由供應商的政策而定
NVIDIA NIM註冊送 1,000 點額度;使用商務電子郵件最高可得 5,000 點不需要未說明
比較各供應商免費方案每日請求上限的橫向長條圖,其中 Groq 的 llama-3.1-8b-instant 以每天 14,400 次請求居首

每日上限從 GitHub Models 上 DeepSeek-R1 的 8 次,到 Groq 8B 端點的 14,400 次都有。不過比較時要留意:請求次數、Token、Neurons 與美元額度並不是同一種計量單位。

Google AI Studio:最適合入門的免費方案,但有兩個前提

對多數開發者來說,Google AI Studio 仍是最值得先試的免費層。無須建立帳務帳戶,就能免費使用 Gemini 3.6 Flash、Gemini 3.5 Flash、Gemini 2.5 Pro 及另外八款文字模型。免費層的資格條件是「啟用中的專案或免費試用」;只有付費 Tier 1 才需要連結帳務資料。

Google 官方用量層級表,顯示 Free 層僅需要啟用中的專案,且不設帳務上限

必須註冊後,才能看到自己的額度

Google 的速率限制頁面已不再公開列出各模型的請求上限,而是要求你到 AI Studio 的專案頁面查看。目前有兩項規則對所有人一致:額度以專案計算,不是以 API 金鑰計算;每日計數器會在太平洋時間午夜重置。在你的控制台確認前,其他地方看到的任何特定 RPM 數字都應視為過時資訊。

免費層的提示詞會用來改善 Google 產品

Google 定價頁上的每一列免費方案都標示「Used to improve our products: Yes」,付費流量則標示為 No。若要傳送客戶資料、保密協議涵蓋的內容,無論額度再大,這一點都足以排除免費層。免費方案也不包含圖片生成,因此免費 Gemini 僅涵蓋文字與 embedding。

Groq:每日額度公開透明,數字一目了然

Groq 不需要登入即可查看各模型的免費層限制

模型RPM每日請求次數每日 Token 數
llama-3.1-8b-instant3014,400500K
llama-3.3-70b-versatile301,000100K
openai/gpt-oss-120b301,000200K
whisper-large-v3202,00028,800 audio-sec

要注意的是每分鐘 Token 上限。llama-3.3-70b 的 TPM 上限為 12K,因此即使每日請求額度看似充裕,長上下文工作仍可能先被限流。資料政策方面,Groq 預設不會保留推論輸入或輸出,也可申請 Zero Data Retention。

若你的情境是短提示詞、高頻請求,例如分類、資料擷取或 webhook 資料補全,只要 8B 模型足夠、且每分鐘不超過 6K Token,Groq 的 8B 端點每天 14,400 次請求,是這裡最划算的免費選擇。

OpenRouter:每天 50 次免費,存入 $10 後提高到 1,000 次

OpenRouter 提供的不是單一廠牌模型,而是所有帶有 :free 後綴的模型。2026 年 7 月 29 日,這個池中共有 15 款文字模型,包括 NVIDIA Nemotron 3 Ultra 與 Ling-3.0-flash。

OpenRouter 依免費模型篩選的模型清單,顯示 NVIDIA Nemotron 3 Ultra 與 Ling-3.0-flash 均為每百萬 Token $0

額度限制是所有免費模型共用:每分鐘 20 次、每天 50 次。只要一次購買 $10 額度,每日上限就會永久提高至 1,000 次,而且那 $10 仍可用於付費模型。換句話說,OpenRouter 實用的免費層實際上需要先投入一次 $10。

免費模型流量會依上游供應商的政策路由,預設不會封鎖可能用輸入資料訓練的供應商。不過你可以在隱私設定中將其封鎖,免費與付費模型須分別切換。至於這個模型池實際適合什麼用途,一位 r/ChatGPTCoding 開發者這樣說:

「我推薦使用 Openrouter API Key 搭配不限量、沒有速率限制的 Deepseek/Deepseek R1 0528 免費模型。它很聰明,推理能力很強。」

免費模型池每月都會更替;可參考目前適合程式開發的模型選擇,逐一比較各模型表現。

另外六種值得認識的免費方案

GitHub Models:有完整 API 的免費實驗場

任何 GitHub 帳戶只要建立 personal access token,就能取得 API 存取權,不用信用卡,也不必另外註冊。沒有 Copilot 訂閱時,你會落在 Copilot Free 欄位:低階模型為 15 RPM/每天 150 次請求,高階模型則是 10 RPM/50 RPD;每次請求上限為 8,000 個輸入 Token 加 4,000 個輸出 Token。推理模型的限制嚴格得多,DeepSeek-R1 每天只能請求 8 次。GitHub 也明確表示,這些限制可隨時變更而不另行通知。

Cloudflare Workers AI:每天 10,000 Neurons,並明確承諾不拿資料訓練

Cloudflare 以 Neurons 計費:每天 10,000 個,在 00:00 UTC 重置,Free 與 Paid Workers 方案都適用。依 Cloudflare 的換算表,使用 llama-3.1-8b-fast 時,大約相當於每天 280K 輸出 Token。Cloudflare 也在文件中明確表示,未經同意不會使用客戶內容訓練模型或改善服務。這是九家中最強的資料承諾,也是處理重視隱私工作時應優先選它的理由。

Cohere、NVIDIA、Hugging Face、Mistral:額度較小或規則不透明

供應商免費額度限制條件
Cohere試用金鑰:20 req/min每月合計僅 1,000 次呼叫,適合評估,不適合正式運作
NVIDIA build.nvidia.com註冊送 1,000 點額度;使用商務電子郵件最高可得 5,000 點一次性額度,非持續免費方案,且未公開點數與請求次數的換算率
Hugging Face Inference Providers200 多款模型共用每月 $0.10 額度僅足夠做示範,且標示為「subject to change」
MistralAPI 金鑰提供免費模式未公開限制,僅會顯示於你的 Admin Panel

不只文字:圖片、語音與 embedding 的零成本選項

文字以外的免費方案通常更有限。圖片生成最明顯:Gemini 的圖片模型在免費層標示為「Not available」,因此 Cloudflare 的 FLUX 部署成了主要的不綁卡選項,但同樣會消耗每天 10,000 Neurons 的額度。語音轉文字的情況較好,Groq 為 whisper-large-v3 提供獨立免費額度,每天 2,000 次請求與 28,800 audio-seconds。embedding 則可選 Gemini 的 gemini-embedding-001 免費層,或 GitHub Models 的 15 RPM/150 RPD,兩者都不需要付費。

資料敏感時,候選名單只剩兩家

在這份清單中,只有 Cloudflare 與 Groq 明確書面承諾不會用免費層輸入資料訓練模型,也不會保留資料。Google 則直接表明會使用資料;其餘五家在你最需要查看的頁面上沒有說明。對真正的使用者資料而言,未說明就代表風險尚未釐清,而非安全。

至於 GitHub repo 或 Discord 伺服器流出的共用、代理 API 金鑰,根本不該納入候選。你的流量會經過陌生人的帳戶,而且該帳戶一旦失效,你的存取權也會隨之中斷。

什麼時候該離開免費層

以下任一情況開始經常發生,就代表你已經超出免費方案的適用範圍:

  • 每日上限開始中斷實際工作,例如 Groq 70B 的每天 100K Token,只夠跑一個中等規模的批次工作。
  • 需要免費層沒有提供的模型類型。前沿推理模型與圖片生成,在上述九種方案中不是沒有,就是受到嚴格限制。
  • 為了躲避額度上限,工程時間開始花在不同供應商之間切換。

超出免費額度後的成本往往比想像中低。按量計費的 flash 級模型以每百萬 Token 計價,因此在 AIReiter 這類聚合平台上,超過 Groq 免費 100K 額度的一天通常只要幾美分。Groq、OpenRouter、Cloudflare 與 Gemini 都提供相容 OpenAI 的端點,切換通常只需要改 base URL。

你的情境繼續免費還是付費?
原型開發,沒有真實使用者資料免費:Google AI Studio(模型廣度)或 Groq(吞吐量)
重視隱私、流量不高免費:Cloudflare Workers AI(不訓練資料保證)
想低成本嘗試大量模型OpenRouter:每天免費 50 次;一次購買 $10 可解鎖每天 1,000 次
每日上限開始干擾實際工作採用按量付費;免費層作為備援

常見問題

有完全免費的 AI API 嗎?

有。截至 2026 年 7 月 29 日,Google AI Studio、Groq、GitHub Models 與 Cloudflare Workers AI 都能在未綁定付款方式的情況下提供可用 API。不過每家都有每日或每分鐘限制;Google 的免費層還會使用你的提示詞來改善其產品。

哪些 AI API 不用信用卡也能免費用?

上方比較表中的九家供應商都能不綁卡取得金鑰。真正差異在於額度規模與資料政策:例如 Groq 每天 14,400 次請求,Cohere 每月只有 1,000 次呼叫;Cloudflare 承諾不拿資料訓練,Google 的立場則正好相反。

哪一種 GPT API 可以免費使用?

OpenAI 自家的 API 沒有免費層,但 OpenAI 的開放權重 gpt-oss 模型可在三個平台免費使用:Groq(gpt-oss-120b,每天 1,000 次請求)、Cloudflare Workers AI(納入每天 10,000 Neurons 額度),以及 OpenRouter(openai/gpt-oss-20b:free)。GitHub Models 的免費層也提供由 Azure 託管的 OpenAI GPT 模型,但不包含 o-series 與 GPT-5 級模型。

最慷慨的免費 AI API 方案是哪一個?

取決於衡量方式。單看請求次數,Groq 的 llama-3.1-8b-instant 每天 14,400 次最多;看 Token 總量,則是 Cloudflare 每天 10,000 Neurons;若看零成本下的模型品質,Google AI Studio 包含 Gemini 2.5 Pro,但代價是你的資料會用於訓練。

延伸閱讀