已閱讀 0%

Gemini 4 Argon API 價格與 100 萬輸出上限

2026年10月5日

Google 公告列出的 Gemini 4 Argon API 首發優惠價為每百萬輸入 Token 2 美元、每百萬輸出 Token 10 美元。公告也列出後續的 4 美元和 20 美元價格,但沒有說明優惠期何時結束。快取輸入便宜 95%,最大輸出量則從 64K 提高到 100 萬 Token。Token 是模型計算文字量的單位。

藍色發布卡片上有 Gemini 標誌和 Gemini 4 Argon 字樣。

來源:Google DeepMind。這張卡片沒有顯示 2 美元和 10 美元的價格;這些價格寫在下方的公告正文中。Logan Kilpatrick 的發布貼文也在正文中說明首發價格,並非另有價格卡片。

Gemini 4 Argon 價格與限制

規格數值資料來源(截至日期)
首發輸入價格每 1M Token 2 美元Google 公告,2026 年 9 月 30 日
首發輸出價格每 1M Token 10 美元Google 公告,2026 年 9 月 30 日
後續輸入價格每 1M Token 4 美元Google 公告;未說明結束日期
後續輸出價格每 1M Token 20 美元Google 公告;未說明結束日期
快取輸入輸入價格優惠 95%Google 公告
最大輸出量1M Token,之前為 64KGoogle 公告
上下文視窗1M Token,由輸入與輸出共用Artificial Analysis 模型紀錄,10 月 5 日查看

這些首發優惠價是截至目前的價格資料,不代表優惠期會在某個特定日期結束。發布狀態頁面說明 Google 列出的存取對象;截至 2026 年 10 月 5 日,一般使用者仍無法呼叫 Argon。

95% 快取折扣怎麼算?

「優惠 95%」表示快取輸入只按標價的 5% 計費。按首發輸入價格 2 美元計算,每百萬快取輸入 Token 約為 0.10 美元;按後續價格 4 美元計算則約為 0.20 美元。折扣只適用於快取輸入讀取,不會降低輸出價格。

舉例來說,假設一次請求使用 100,000 個新處理的輸入 Token 和 20,000 個輸出 Token,按首發優惠價計算就是 0.20 美元 + 0.20 美元 = 0.40 美元,不考慮快取影響。符合快取條件的重複輸入會按折扣價計費;實際請求的 Token 數量和快取行為可能不同。

輸出容量不等於上下文容量

Google 公告將單次任務的輸出上限從 64K 提高到 1M Token。Artificial Analysis 紀錄的上下文視窗也是 1M Token,但由輸入與輸出共用。這是兩個不同的限制:輸出上限表示一次回覆最多能產生多少內容,上下文表示一次請求可用的輸入與輸出總容量。

1M 輸出上限不表示一次請求可以同時使用 1M 輸入 Token 和 1M 輸出 Token。它為長時間執行的任務提供更多空間,避免回覆過早截斷;品質、延遲和任務實際使用的 Token 數量仍取決於請求本身。

標價沒有告訴你的事

Artificial Analysis 列出的 Intelligence Index 單次任務成本約為 1.99 美元。這是加權評測成本估算,不是每位客戶都要支付的固定費用,也不是所有工作負載的成本預測。不同來源的跑分見 Gemini 4 Argon 基準測試;15.1% 數字的含義請看 Argon 幻覺率解讀。

如果你需要不按 Token 計費的本地模型,可以下載 Gemma 4並查看安裝方案。Gemma 4 與 Gemini 4 Argon 屬於不同模型系列。

gemma4 — interact

線上體驗 Gemma 4

~/gemma4 $ 先在瀏覽器中試用 Gemma 4,再決定是否在本機安裝。

開啟 Gemma 4 線上體驗 />
Gemma 4 AI

Gemma 4 AI

相關指南