在 2026 年 10 月 5 日的对比数据中,Gemini 4 Argon High 的 Artificial Analysis Intelligence Index 单次任务成本为 1.99 美元,GPT-6.1 Sol Max 为 0.72 美元。Sol 的估算任务成本低约 64%,Argon 的估算值约为 Sol 的 2.8 倍。这个数字适合比较评测工作负载,并不是固定的 API 费用。
来源:@StatsWire,使用 Artificial Analysis 的 Intelligence Index 单次任务成本数据。图中 Argon(High)为 1.99 美元,并标注为尚未公开提供;GPT-6.1 Sol(Max)为 0.72 美元;Astra(Max)为 3.26 美元;Claude Opus 5.5(Max)为 5.98 美元。Argon 和 Sol 的数字与下方对比表一致。这是一张更广泛的榜单图,不是两款模型的账单。
Argon High 与 Sol Max:截至 10 月 5 日的数据
Artificial Analysis 对比使用了以下配置,并报告四舍五入后的指数值和估算任务成本:
| 指标 | Gemini 4 Argon High | GPT-6.1 Sol Max |
|---|---|---|
| 快照日期 | 2026 年 10 月 5 日 | 2026 年 10 月 5 日 |
| Artificial Analysis Intelligence Index | 53 | 52 |
| 估算的单次任务成本 | $1.99 | $0.72 |
在这份数据中,Argon 高 1 个指数点;Sol 的估算单次任务成本约为 Argon 的 36%。Argon 的底层指数记录在四舍五入为 53 之前是 52.5606;对比页面显示的是四舍五入后的值。
这里的“单次任务成本”是什么意思?
Artificial Analysis 根据 Intelligence Index 各项任务所需的 Token 和模型用量,计算加权评测成本。这是评测成本估算,不是每次请求收取的固定费用、订阅价格,也不保证客户的一次 Sol 任务恰好花费 0.72 美元。
这个比值也取决于工作负载。需要更多上下文、更长输出、重试或工具调用的任务,成本可能不同于指数背后的加权组合。可以用这份快照判断 Argon 的质量差异是否值得在自己的工作负载上测试。
Token 价格是另一项比较
同一份 Artificial Analysis 对比列出了这些配置相同的 Token 价格:
| 价格项目 | Gemini 4 Argon High | GPT-6.1 Sol Max |
|---|---|---|
| 每 1M Token 输入 / 输出 | $2 / $10 | $2 / $10 |
| 每 1M Token 缓存输入 | $0.10 | $0.10 |
Token 价格相同,不代表完成一项任务的成本相同。不同模型可能使用不同数量的 Token 和重试次数,才能完成同一个评测。
应该先测试哪个模型?
如果优先考虑较低的评测估算成本,并且你的工作负载可以接受指数差 1 分,可以先测试 Sol。如果额外的任务成本可能换来足够的质量或可靠性,从而减少重试和审阅时间,可以测试 Argon。这是根据快照作出的实践推断,不保证适用于每个项目。
根据 Google 公告,Argon 公布的首发 API 价格同样是每百万输入 Token 2 美元、每百万输出 Token 10 美元。Argon 发布页面说明了分阶段访问;Artificial Analysis 的任务估算不代表所有调用者都能使用模型。


