非官方指南,与 Meta 无关联。

最后更新:

Gemini 4 Argon 和 GPT-6 Astra 对比

Google 的新一代旗舰对上 OpenAI 的旗舰。两个都是各家最强的模型,Argon 每 token 便宜得多。

一句话 按 Google 的数据,在双方都有成绩的 19 项测试里 Argon 赢了 14 项,就算按标准价每 token 也便宜 2.5 倍。Astra 领先的是 FrontierSWE v2, Terminal-Bench 4.0, Terminal-Bench Science 0.1, OSWorld-2.0。问题在于 Astra 已全面开放,Argon 还没有。

参数对比

Gemini 4 ArgonGPT-6 Astra
开发方Google DeepMindOpenAI
发布日期2026年9月30日(仅 Fairwind 计划)2026年9月4日
输入 / 输出(每百万)首发 $2 / $10,标准 $4 / $20$10 / $50
缓存输入(每百万)首发 $0.10,标准 $0.20$1
最大输出100 万 token128K token
上下文窗口—1.05M

跑分

数据来自 Google 的 Gemini 4 Argon 跑分表,所有模型都按最高思考档测试。OpenAI 自己公布的对比可能不同。

测试Gemini 4 ArgonGPT-6 Astra
Vals Index68.9%63.1%
AutomationBench51.3%41.4%
Vals Finance Agent v265.4%53.5%
Harvey's Legal Agent Benchmark19.6%5.4%
DeepSWE v1.177.9%74.1%
FrontierSWE v255.0%65.5%
Vibe Code Bench91.9%89.6%
Terminal-Bench 4.057.4%58.2%
PostTrainBench45.3%44.3%
Terminal-Bench Science 0.157.6%68.1%
LABBench 288.8%85.4%
RiemannBench76.0%72.0%
GraphWalks BFS (up to 128K)99.7%98.7%
GraphWalks BFS (256K-1M)84.2%71.8%
Agent's Last Exam39.5%34.2%
OSWorld-2.069.2%72.6%
Chartography71.6%71.0%
LVBench91.7%87.5%
CWE-bench v168.0%68.0%

Argon 领先 14 项,GPT-6 Astra 领先 4 项,并列 1 项。

来源: Google DeepMind 官方:Gemini 模型页

每次编程任务的成本

代码库规模Argon(首发价)Argon(标准价)GPT-6 Astra
小(1 万行以内)$0.112$0.223$0.576
中(1 万-10 万行)$0.249$0.498$1.290
大 / monorepo(10 万行以上)$0.594$1.188$3.090

每月 173 次任务、中等代码库:Argon 首发价约 $43(标准价约 $86),GPT-6 Astra 约 $223,两边按同样的 token 量计算。

Gemini 4 Argon 详细介绍 在计算器里对比所有模型

怎么选

常见问题

Gemini 4 Argon 比 GPT-6 强吗?

按 Google 的数据,在双方都有成绩的 19 项测试里 Argon 赢了 14 项,并列 1 项;Astra 领先的是 FrontierSWE v2, Terminal-Bench 4.0, Terminal-Bench Science 0.1, OSWorld-2.0。

Gemini 4 Argon 和 GPT-6 Astra 哪个便宜?

Argon:首发 $2 / $10,之后 $4 / $20;Astra 是 $10 / $50。

Gemini 4 Argon 和 GPT-6.1 Sol 比呢?

GPT-6.1 Sol 标价 $2 / $10,和 Argon 首发价一样,而且现在就能用。Google 的跑分表里没有它。

独立站点,与 Google、OpenAI、Meta 均无关联。跑分为 Google 公布,本站没有自己做测试。