2026 年 Gemini API 新制:預付抵免額怎麼運作?新創團隊該怎麼設定
整理 Gemini API 預付抵免額的運作方式、目前開放情況與新創團隊設定時該注意的計費邏輯。
目錄展開
如果你曾經在深夜緊盯監控儀表板,擔心隔天醒來 API 帳單爆炸,那麼 Google 最新推出的 Gemini API 預付(Prepay)機制,絕對值得你花三分鐘了解。
TL;DR: 預付 = 先儲值、用完就停;避免隔夜帳單爆表;目前美國先開放,其他地區逐漸開放。
什麼是 Gemini API 預付機制?
Gemini API 的付費方案分為免費層級與付費層級(即付即用),新推出的預付機制要求使用者在啟用付費層級時,先儲值一筆金額作為抵免額(Credit)。
請注意:抵免額僅限 Gemini API,Compute Engine、Cloud Storage、Vertex AI 等其他 Google Cloud 服務仍採標準計費,不會從這筆預付餘額扣除。
整個流程很簡單:
- 進入 AI Studio 的 API key 介面,點擊「帳單帳戶」→「新增帳單帳戶」
- 走到付款步驟時,系統會跳出預付儲值金額的選項(若該地區尚未開放,這個選項不會出現)
- 選定金額並完成付款後,專案會升級至付費層級並套用對應的速率限制(更高的 Tier 2/3 仍需符合累積消費與帳戶資歷條件)
為什麼這對開發者很重要?
過去在使用結算制 API 時,一旦流量異常或程式邏輯出錯,帳單可能在你睡覺的時候默默滾大。常見應對方式是自己寫自動化腳本監控用量、設定預算警報、甚至在超標時自動關閉服務——但這些方案都有潛在的延遲風險:腳本可能幾分鐘後才觸發,這幾分鐘已經夠燒一筆錢了。
預付機制從根本上解決了這個問題。
預付抵免額用盡後,Gemini API 會直接停止受理付費層級的請求,等於替你設了一道天然的消費上限。只有在帳戶符合條件、且你主動選擇升級到 Postpay(後付)模式時,帳單才會走標準計費流程。對於資源有限的新創小團隊或個人開發者,這種「先儲值、再用量」的模式讓財務控管變得直觀許多,不需要再依賴複雜的外部監控機制。
目前開放狀況:台灣尚未開放
根據 Google 官方部落格公告,預付功能目前先從美國開始推出,接下來幾週才會逐步向其他地區開放。
個人實測台灣目前走完「新增帳單帳戶」流程,付款頁面不會跳出預付儲值金額的選項,等於地區仍未開放。如果你也等不及,建議定期關注 Google AI Studio 的帳單設定頁面,一旦台灣開放,儲值選項應該就會在付款步驟出現。
其他值得注意的細節
- 預付款不影響 Google Cloud $300 美元免費試用抵免額,兩者各自獨立。 兩筆額度分屬不同計費體系,使用上互不干擾。
- 新使用者啟用 Cloud Billing 後,可獲得 $300 美元的歡迎抵免額,但須在 90 天內使用完畢,且僅限從未付費過的 Google Cloud 新帳號。
- 預付抵免額可退款,但有效期為 12 個月。 購買後 12 個月內可透過 Cloud Console 申請退款;若日後升級到 Postpay(後付)計費,Cloud Billing 會自動將未使用的餘額退還。注意:抵免額 12 個月後過期作廢,且若因升級以外的原因關閉 Prepay 帳戶,剩餘餘額將作廢。
- 失敗的 API 請求(400/500 錯誤)不會計費,但仍會計入配額。 寫重試邏輯時要特別小心,盲目重試雖然不會被扣 token 費用,但仍會消耗 TPM/RPM 配額。
小結
Gemini API 預付機制雖然看起來是個小更新,但對開發初期預算敏感的團隊來說,意義相當實際。少寫一個監控腳本、少一個隔天醒來的焦慮,就是開發體驗的一大步。
台灣的朋友們先耐心等候,可訂閱 Google AI Studio 官方部落格,或追蹤 @googleaistudio 接收後續地區開放消息,正式開放後記得回來設定!
想從另一個方向壓低 API 帳單,可以參考提示詞快取失效解析:系統提示詞裡一行每次重新產生的時間戳記,就足以讓快取一次都讀不到,等於每個請求都付全額。
參考資料:
相關文章
h3.c 跑 MiniMax H3 實測:M5 Pro 64GB 記憶體與 VAE 接縫修正
在 M5 Pro 64GB 上用 h3.c 跑 MiniMax H3,整理 134 GiB 權重下載、Metal 建置、效能與尺寸限制,以及 Video VAE 接縫修正。
MiniMax H3 在 M5 Pro 實測:ComfyUI 安裝、M5 Kernel 與 64GB 記憶體調校
在 M5 Pro 64GB 上用 ComfyUI 跑通 MiniMax H3,整理模型下載、PyTorch nightly、M5 Metal Kernel、啟動參數與記憶體調校實測。
提示詞快取失效解析:系統提示詞多一行日期,本機模型就重新預填
拆解本機模型的預填與前綴快取:為什麼系統提示詞多一行日期,就讓 250k context 的工作階段重新預填 20 分鐘,以及提示詞該怎麼排版才能穩定命中快取,並對照 Anthropic 商業 API 的快取規則。