Atualizado em:
Gemini 4 Argon vs Claude Opus 5.5
O novo modelo de fronteira do Google contra o melhor modelo da Anthropic liberado para todos. No preço padrão, os dois custam exatamente o mesmo por token.
Lado a lado
| Gemini 4 Argon | Opus 5.5 | |
|---|---|---|
| Empresa | Google DeepMind | Anthropic |
| Lançamento | 30 de setembro de 2026 (só programa Fairwind) | 22 de setembro de 2026 |
| Entrada / saída por milhão | $2 / $10 lançamento, $4 / $20 padrão | $4 / $20 |
| Entrada em cache por milhão | $0.10 lançamento, $0.20 padrão | $0.20 |
| Saída máxima | 1M de tokens | 128K tokens |
| Janela de contexto | — | 1M |
Benchmarks
Da tabela do Gemini 4 Argon do Google. O Google rodou cada modelo no nível de raciocínio mais alto. A Anthropic publica as próprias comparações, que podem ser diferentes.
| Benchmark | Gemini 4 Argon | Opus 5.5 |
|---|---|---|
| Vals Index | 68,9% | 67,0% |
| AutomationBench | 51,3% | 42,5% |
| Vals Finance Agent v2 | 65,4% | 58,6% |
| Harvey's Legal Agent Benchmark | 19,6% | 3,8% |
| DeepSWE v1.1 | 77,9% | 74,2% |
| FrontierSWE v2 | 55,0% | 62,3% |
| Vibe Code Bench | 91,9% | 90,3% |
| Terminal-Bench 4.0 | 57,4% | 66,4% |
| PostTrainBench | 45,3% | 49,3% |
| Terminal-Bench Science 0.1 | 57,6% | 63,3% |
| LABBench 2 | 88,8% | 73,1% |
| RiemannBench | 76,0% | 69,6% |
| GraphWalks BFS (up to 128K) | 99,7% | 90,6% |
| GraphWalks BFS (256K-1M) | 84,2% | 66,8% |
| Agent's Last Exam | 39,5% | 38,2% |
| OSWorld-2.0 | 69,2% | — |
| Chartography | 71,6% | 66,3% |
| LVBench | 91,7% | 83,7% |
| CWE-bench v1 | 68,0% | 67,0% |
O Argon vence em 14, o Opus 5.5 em 4 e 0 ficam empatados.
Fonte: Google DeepMind: página dos modelos Gemini
Custo por tarefa de programação
| Tamanho do código | Argon (lançamento) | Argon (padrão) | Opus 5.5 |
|---|---|---|---|
| Pequeno (< 10 mil linhas) | $0.112 | $0.223 | $0.223 |
| Médio (10 mil-100 mil linhas) | $0.249 | $0.498 | $0.498 |
| Grande / monorepo (> 100 mil linhas) | $0.594 | $1.188 | $1.188 |
Com 173 tarefas por mês em código médio: cerca de $43 no Argon pelo preço de lançamento ($86 no padrão) e $86 no Opus 5.5, com os mesmos tokens para os dois.
Gemini 4 Argon: todos os detalhes Compare todos os modelos na calculadora
Qual escolher
- Agentes de programação no terminal hoje: Opus 5.5, que lidera no Terminal-Bench 4.0 e já funciona no Claude Code.
- Trabalho jurídico, financeiro e automação de negócio: o Argon foi muito melhor no benchmark jurídico da Harvey e no AutomationBench (51,3% contra 42,5%).
- Entradas muito longas: Argon, no GraphWalks de 256K a 1M (84,2% contra 66,8%).
- Orçamento: o preço de lançamento do Argon é metade do Opus 5.5, quando você tiver acesso.
Perguntas frequentes
O Gemini 4 Argon é melhor que o Opus 5.5?
Na tabela do Google, o Argon supera o Opus 5.5 em 14 de 18 benchmarks em comum. O Opus 5.5 fica na frente em FrontierSWE v2, Terminal-Bench 4.0, PostTrainBench, Terminal-Bench Science 0.1. Cada empresa escolhe os benchmarks que favorecem, então teste no seu trabalho.
Qual é mais barato, Gemini 4 Argon ou Opus 5.5?
O Argon no preço de lançamento ($2 / $10). No preço padrão ($4 / $20) custa o mesmo que o Opus 5.5.
Dá para usar o Gemini 4 Argon no lugar do Opus 5.5 hoje?
Só se você estiver no programa de segurança Fairwind do Google. Os próximos são os clientes pagos da API do Gemini e os assinantes do Google AI Ultra, sem data.
Página independente, sem vínculo com Google, Anthropic ou Meta. Os benchmarks foram publicados pelo Google; não fizemos testes próprios.