Guia não oficial. Sem vínculo com a Meta.

Atualizado em:

Gemini 4 Argon vs Claude Opus 5.5

O novo modelo de fronteira do Google contra o melhor modelo da Anthropic liberado para todos. No preço padrão, os dois custam exatamente o mesmo por token.

Resposta curta Na tabela do Google, o Argon vence 14 de 18 benchmarks em comum, incluindo o DeepSWE (77,9% contra 74,2%), mas o Opus 5.5 lidera no Terminal-Bench 4.0 (66,4% contra 57,4%) e já dá para usar. Para agentes de programação no terminal, Opus 5.5 agora; teste o Argon em trabalho jurídico, financeiro e de contexto longo quando abrir.

Lado a lado

Gemini 4 ArgonOpus 5.5
EmpresaGoogle DeepMindAnthropic
Lançamento30 de setembro de 2026 (só programa Fairwind)22 de setembro de 2026
Entrada / saída por milhão$2 / $10 lançamento, $4 / $20 padrão$4 / $20
Entrada em cache por milhão$0.10 lançamento, $0.20 padrão$0.20
Saída máxima1M de tokens128K tokens
Janela de contexto—1M

Benchmarks

Da tabela do Gemini 4 Argon do Google. O Google rodou cada modelo no nível de raciocínio mais alto. A Anthropic publica as próprias comparações, que podem ser diferentes.

BenchmarkGemini 4 ArgonOpus 5.5
Vals Index68,9%67,0%
AutomationBench51,3%42,5%
Vals Finance Agent v265,4%58,6%
Harvey's Legal Agent Benchmark19,6%3,8%
DeepSWE v1.177,9%74,2%
FrontierSWE v255,0%62,3%
Vibe Code Bench91,9%90,3%
Terminal-Bench 4.057,4%66,4%
PostTrainBench45,3%49,3%
Terminal-Bench Science 0.157,6%63,3%
LABBench 288,8%73,1%
RiemannBench76,0%69,6%
GraphWalks BFS (up to 128K)99,7%90,6%
GraphWalks BFS (256K-1M)84,2%66,8%
Agent's Last Exam39,5%38,2%
OSWorld-2.069,2%—
Chartography71,6%66,3%
LVBench91,7%83,7%
CWE-bench v168,0%67,0%

O Argon vence em 14, o Opus 5.5 em 4 e 0 ficam empatados.

Fonte: Google DeepMind: página dos modelos Gemini

Custo por tarefa de programação

Tamanho do códigoArgon (lançamento)Argon (padrão)Opus 5.5
Pequeno (< 10 mil linhas)$0.112$0.223$0.223
Médio (10 mil-100 mil linhas)$0.249$0.498$0.498
Grande / monorepo (> 100 mil linhas)$0.594$1.188$1.188

Com 173 tarefas por mês em código médio: cerca de $43 no Argon pelo preço de lançamento ($86 no padrão) e $86 no Opus 5.5, com os mesmos tokens para os dois.

Gemini 4 Argon: todos os detalhes Compare todos os modelos na calculadora

Qual escolher

Perguntas frequentes

O Gemini 4 Argon é melhor que o Opus 5.5?

Na tabela do Google, o Argon supera o Opus 5.5 em 14 de 18 benchmarks em comum. O Opus 5.5 fica na frente em FrontierSWE v2, Terminal-Bench 4.0, PostTrainBench, Terminal-Bench Science 0.1. Cada empresa escolhe os benchmarks que favorecem, então teste no seu trabalho.

Qual é mais barato, Gemini 4 Argon ou Opus 5.5?

O Argon no preço de lançamento ($2 / $10). No preço padrão ($4 / $20) custa o mesmo que o Opus 5.5.

Dá para usar o Gemini 4 Argon no lugar do Opus 5.5 hoje?

Só se você estiver no programa de segurança Fairwind do Google. Os próximos são os clientes pagos da API do Gemini e os assinantes do Google AI Ultra, sem data.

Página independente, sem vínculo com Google, Anthropic ou Meta. Os benchmarks foram publicados pelo Google; não fizemos testes próprios.