Última actualización:
Gemini 4 Argon vs Claude Opus 5.5
El nuevo modelo de frontera de Google contra el mejor modelo de Anthropic disponible para todos. A precio estándar cuestan exactamente lo mismo por token.
Lado a lado
| Gemini 4 Argon | Opus 5.5 | |
|---|---|---|
| Empresa | Google DeepMind | Anthropic |
| Lanzamiento | 30 de septiembre de 2026 (solo programa Fairwind) | 22 de septiembre de 2026 |
| Entrada / salida por millón | $2 / $10 lanzamiento, $4 / $20 estándar | $4 / $20 |
| Entrada en caché por millón | $0.10 lanzamiento, $0.20 estándar | $0.20 |
| Salida máxima | 1M de tokens | 128K tokens |
| Ventana de contexto | — | 1M |
Benchmarks
De la tabla de Gemini 4 Argon de Google. Google corrió cada modelo con su nivel de razonamiento más alto. Anthropic publica sus propias comparaciones, que pueden no coincidir.
| Benchmark | Gemini 4 Argon | Opus 5.5 |
|---|---|---|
| Vals Index | 68.9% | 67.0% |
| AutomationBench | 51.3% | 42.5% |
| Vals Finance Agent v2 | 65.4% | 58.6% |
| Harvey's Legal Agent Benchmark | 19.6% | 3.8% |
| DeepSWE v1.1 | 77.9% | 74.2% |
| FrontierSWE v2 | 55.0% | 62.3% |
| Vibe Code Bench | 91.9% | 90.3% |
| Terminal-Bench 4.0 | 57.4% | 66.4% |
| PostTrainBench | 45.3% | 49.3% |
| Terminal-Bench Science 0.1 | 57.6% | 63.3% |
| LABBench 2 | 88.8% | 73.1% |
| RiemannBench | 76.0% | 69.6% |
| GraphWalks BFS (up to 128K) | 99.7% | 90.6% |
| GraphWalks BFS (256K-1M) | 84.2% | 66.8% |
| Agent's Last Exam | 39.5% | 38.2% |
| OSWorld-2.0 | 69.2% | — |
| Chartography | 71.6% | 66.3% |
| LVBench | 91.7% | 83.7% |
| CWE-bench v1 | 68.0% | 67.0% |
Argon gana en 14, Opus 5.5 en 4 y 0 terminan empatados.
Fuente: Google DeepMind: página de modelos Gemini
Costo por tarea de programación
| Tamaño del código | Argon (lanzamiento) | Argon (estándar) | Opus 5.5 |
|---|---|---|---|
| Pequeño (< 10k líneas) | $0.112 | $0.223 | $0.223 |
| Mediano (10k-100k líneas) | $0.249 | $0.498 | $0.498 |
| Grande / monorepo (> 100k líneas) | $0.594 | $1.188 | $1.188 |
Con 173 tareas al mes en código mediano: unos $43 con Argon a precio de lanzamiento ($86 a precio estándar) y $86 con Opus 5.5, con los mismos tokens para los dos.
Gemini 4 Argon: todos los detalles Compara todos los modelos en la calculadora
Cuál elegir
- Agentes de programación en terminal hoy: Opus 5.5, que gana en Terminal-Bench 4.0 y ya funciona en Claude Code.
- Trabajo legal, financiero y automatización de negocio: Argon sacó mucho más en el benchmark legal de Harvey y en AutomationBench (51.3% contra 42.5%).
- Entradas muy largas: Argon, en GraphWalks de 256K a 1M (84.2% contra 66.8%).
- Presupuesto: el precio de lanzamiento de Argon es la mitad que Opus 5.5, cuando puedas acceder.
Preguntas frecuentes
¿Gemini 4 Argon es mejor que Opus 5.5?
En la tabla de Google, Argon le gana a Opus 5.5 en 14 de 18 benchmarks compartidos. Opus 5.5 va adelante en FrontierSWE v2, Terminal-Bench 4.0, PostTrainBench, Terminal-Bench Science 0.1. Cada empresa elige los benchmarks que le convienen, así que prueba con tu propio trabajo.
¿Cuál es más barato, Gemini 4 Argon u Opus 5.5?
Argon a precio de lanzamiento ($2 / $10). A precio estándar ($4 / $20) cuesta lo mismo que Opus 5.5.
¿Puedo usar Gemini 4 Argon en vez de Opus 5.5 hoy?
Solo si estás en el programa de seguridad Fairwind de Google. Los siguientes son los clientes de pago de la API de Gemini y los suscriptores de Google AI Ultra, sin fecha.
Página independiente, sin relación con Google, Anthropic ni Meta. Los benchmarks los publicó Google; no hicimos pruebas propias.