Google 公告列出的 Gemini 4 Argon API 首發優惠價為每百萬輸入 Token 2 美元、每百萬輸出 Token 10 美元。公告也列出後續的 4 美元和 20 美元價格,但沒有說明優惠期何時結束。快取輸入便宜 95%,最大輸出量則從 64K 提高到 100 萬 Token。Token 是模型計算文字量的單位。
來源:Google DeepMind。這張卡片沒有顯示 2 美元和 10 美元的價格;這些價格寫在下方的公告正文中。Logan Kilpatrick 的發布貼文也在正文中說明首發價格,並非另有價格卡片。
Gemini 4 Argon 價格與限制
| 規格 | 數值 | 資料來源(截至日期) |
|---|---|---|
| 首發輸入價格 | 每 1M Token 2 美元 | Google 公告,2026 年 9 月 30 日 |
| 首發輸出價格 | 每 1M Token 10 美元 | Google 公告,2026 年 9 月 30 日 |
| 後續輸入價格 | 每 1M Token 4 美元 | Google 公告;未說明結束日期 |
| 後續輸出價格 | 每 1M Token 20 美元 | Google 公告;未說明結束日期 |
| 快取輸入 | 輸入價格優惠 95% | Google 公告 |
| 最大輸出量 | 1M Token,之前為 64K | Google 公告 |
| 上下文視窗 | 1M Token,由輸入與輸出共用 | Artificial Analysis 模型紀錄,10 月 5 日查看 |
這些首發優惠價是截至目前的價格資料,不代表優惠期會在某個特定日期結束。發布狀態頁面說明 Google 列出的存取對象;截至 2026 年 10 月 5 日,一般使用者仍無法呼叫 Argon。
95% 快取折扣怎麼算?
「優惠 95%」表示快取輸入只按標價的 5% 計費。按首發輸入價格 2 美元計算,每百萬快取輸入 Token 約為 0.10 美元;按後續價格 4 美元計算則約為 0.20 美元。折扣只適用於快取輸入讀取,不會降低輸出價格。
舉例來說,假設一次請求使用 100,000 個新處理的輸入 Token 和 20,000 個輸出 Token,按首發優惠價計算就是 0.20 美元 + 0.20 美元 = 0.40 美元,不考慮快取影響。符合快取條件的重複輸入會按折扣價計費;實際請求的 Token 數量和快取行為可能不同。
輸出容量不等於上下文容量
Google 公告將單次任務的輸出上限從 64K 提高到 1M Token。Artificial Analysis 紀錄的上下文視窗也是 1M Token,但由輸入與輸出共用。這是兩個不同的限制:輸出上限表示一次回覆最多能產生多少內容,上下文表示一次請求可用的輸入與輸出總容量。
1M 輸出上限不表示一次請求可以同時使用 1M 輸入 Token 和 1M 輸出 Token。它為長時間執行的任務提供更多空間,避免回覆過早截斷;品質、延遲和任務實際使用的 Token 數量仍取決於請求本身。
標價沒有告訴你的事
Artificial Analysis 列出的 Intelligence Index 單次任務成本約為 1.99 美元。這是加權評測成本估算,不是每位客戶都要支付的固定費用,也不是所有工作負載的成本預測。不同來源的跑分見 Gemini 4 Argon 基準測試;15.1% 數字的含義請看 Argon 幻覺率解讀。
如果你需要不按 Token 計費的本地模型,可以下載 Gemma 4並查看安裝方案。Gemma 4 與 Gemini 4 Argon 屬於不同模型系列。


