最后更新:
Gemini 4 Argon:价格、使用门槛和跑分
Gemini 4 Argon 是 Google DeepMind 新一代旗舰模型,也是 Gemini 4 系列的第一个模型。Google 在2026年9月30日发布了它,但目前只有一小批网络安全合作方能用。
基本信息
| 开发方 | Google DeepMind |
|---|---|
| 发布日期 | 2026年9月30日 |
| 现在谁能用 | 加入 Google Fairwind 计划的网络安全团队 |
| 下一批开放 | 付费 Gemini API 用户和 Google AI Ultra 订阅用户;Google 说"尽快",没给日期 |
| 首发价(每百万) | 输入 $2,输出 $10,缓存输入 $0.10 |
| 标准价(每百万) | 首发期结束后输入 $4,输出 $20 |
| 最大输出 | 单次回复最多 100 万 token(此前 Gemini 上限是 6.4 万) |
| 擅长 | agent 编程、法律和金融类工作、长上下文、图表和长视频理解、发现并修补安全漏洞 |
来源: Google 官方:Gemini 4 Argon 发布文章
Gemini 4 Argon API 价格
| 价格档 | 输入 | 缓存输入 | 输出 |
|---|---|---|---|
| 首发价 | $2 | $0.10 | $10 |
| 标准价 | $4 | $0.20 | $20 |
- 缓存输入比正常输入便宜 95%。
- Google 没说首发价什么时候结束。之后 Argon 为 $4 / $20,和 Claude Opus 5.5 的标价一样。
- GPT-6 Astra 是 $10 / $50,所以就算按标准价,Argon 也比 OpenAI 的旗舰便宜。
来源: Google 官方:Gemini 4 Argon 发布文章
怎么用上 Gemini 4 Argon
- 现在:只能通过 Fairwind 计划。这是 Google 给经过审核的网络安全防御方(政府、关键基础设施运营方、安全实验室等)开的通道,成员拿到的是去掉网络安全限制的版本,只能用于防御。
- 下一步:付费 Gemini API 用户和 Google AI Ultra 订阅用户。Google 说会"尽快"开放,没有给日期。
- 为什么要等:Argon 被训练成能自己发现并修补软件漏洞,Google 在扩大开放前先参加美国政府的自愿发布前测试。
- 等待期间:如果现在就需要同价位的顶级模型,Claude Opus 5.5 已全面开放,标价同样是 $4 / $20。
跑分(Google 公布)
数据来自 Google 的 Gemini 模型页,所有模型都按最高思考档测试。每行最高分加粗。
| 测试 | Gemini 4 Argon | Opus 5.5 | GPT-6 Astra | Fable 5.1 |
|---|---|---|---|---|
| Vals Index | 68.9% | 67.0% | 63.1% | 65.8% |
| AutomationBench | 51.3% | 42.5% | 41.4% | 31.4% |
| Vals Finance Agent v2 | 65.4% | 58.6% | 53.5% | 58.9% |
| Harvey's Legal Agent Benchmark | 19.6% | 3.8% | 5.4% | 6.7% |
| DeepSWE v1.1 | 77.9% | 74.2% | 74.1% | 67.4% |
| FrontierSWE v2 | 55.0% | 62.3% | 65.5% | 56.3% |
| Vibe Code Bench | 91.9% | 90.3% | 89.6% | 90.3% |
| Terminal-Bench 4.0 | 57.4% | 66.4% | 58.2% | 57.9% |
| PostTrainBench | 45.3% | 49.3% | 44.3% | 40.2% |
| Terminal-Bench Science 0.1 | 57.6% | 63.3% | 68.1% | 52.6% |
| LABBench 2 | 88.8% | 73.1% | 85.4% | 68.6% |
| RiemannBench | 76.0% | 69.6% | 72.0% | 65.6% |
| GraphWalks BFS (up to 128K) | 99.7% | 90.6% | 98.7% | 91.4% |
| GraphWalks BFS (256K-1M) | 84.2% | 66.8% | 71.8% | 65.0% |
| Agent's Last Exam | 39.5% | 38.2% | 34.2% | — |
| OSWorld-2.0 | 69.2% | — | 72.6% | — |
| Chartography | 71.6% | 66.3% | 71.0% | 46.2% |
| LVBench | 91.7% | 83.7% | 87.5% | 79.7% |
| CWE-bench v1 | 68.0% | 67.0% | 68.0% | 58.0% |
领先最多的:Harvey 法律 agent 测试(19.6%,Opus 5.5 是 3.8%)、AutomationBench(51.3% 对 42.5%)、256K 到 1M 的长上下文 GraphWalks(84.2% 对 66.8%)、DeepSWE(77.9% 对 74.2%)。
落后的:Terminal-Bench 4.0(57.4%,Opus 5.5 是 66.4%)、FrontierSWE v2(55.0%,GPT-6 Astra 是 65.5%),以及 Terminal-Bench Science 和 OSWorld-2.0。
来源: Google DeepMind 官方:Gemini 模型页
来源: Google DeepMind 官方:评测方法(PDF)
每次编程任务的成本
按官方标价和成本计算器的假设,每次 agent 任务:
| 代码库规模 | Argon(首发价) | Argon(标准价) | Opus 5.5 | GPT-6 Astra |
|---|---|---|---|---|
| 小(1 万行以内) | $0.112 | $0.223 | $0.223 | $0.576 |
| 中(1 万-10 万行) | $0.249 | $0.498 | $0.498 | $1.290 |
| 大 / monorepo(10 万行以上) | $0.594 | $1.188 | $1.188 | $3.090 |
每月 173 次任务、中等代码库:Argon 首发价约 $43(标准价约 $86),Claude Opus 5.5 约 $86,GPT-6 Astra 约 $223。这里每个模型按同样的 token 量算,实际用量会因模型而异。
Gemini 4 Argon 和 Opus 5.5 对比 Gemini 4 Argon 和 GPT-6 Astra 对比 所有模型价格
媒体怎么说
- VentureBeat: 认为 Google 从 OpenAI 和 Anthropic 手里夺回了跑分第一,但只是小范围发布。
- Axios: 这是 Google 近一年来第一个新旗舰,此前预期的 Gemini 3.5 Pro 一直没出。
- 9to5Google: 整理了首发价、标准价和开放顺序。
- MarkTechPost: 重点讲 100 万 token 输出上限和网络安全防御场景。
常见问题
Gemini 4 Argon 发布了吗?
2026年9月30日已发布,但目前只有 Google Fairwind 网络安全计划的成员能用。下一批是付费 API 用户和 Google AI Ultra 订阅用户,还没有日期。
Gemini 4 Argon 多少钱?
首发价每百万输入 token $2,输出 $10,缓存输入 $0.10。首发期结束后为 $4 / $20。
Gemini 4 Argon 能免费用吗?
不能。Google 只提到了付费渠道:付费 Gemini API 和 Google AI Ultra 订阅,而且这两个都还没开放。
Gemini 4 Argon 比 Claude Opus 5.5 强吗?
按 Google 的数据,大多数测试 Argon 更高,比如 DeepSWE(77.9% 对 74.2%);Terminal-Bench 4.0 上 Opus 5.5 领先(66.4% 对 57.4%)。详见本站的完整对比。
Fairwind 计划是什么?
Google 给可信网络安全防御方(政府、关键基础设施、安全实验室等)的抢先使用通道。成员拿到去掉网络安全限制的 Argon,只用于防御性安全工作。
独立站点,与 Google 无关联。跑分为 Google 自己公布,本站没有自己做测试。