Guía no oficial. Sin relación con Meta.

Última actualización:

Gemini 4 Argon vs Claude Opus 5.5

El nuevo modelo de frontera de Google contra el mejor modelo de Anthropic disponible para todos. A precio estándar cuestan exactamente lo mismo por token.

Respuesta corta En la tabla de Google, Argon gana 14 de 18 benchmarks compartidos, incluido DeepSWE (77.9% contra 74.2%), pero Opus 5.5 va adelante en Terminal-Bench 4.0 (66.4% contra 57.4%) y lo puedes usar hoy. Para agentes de programación en terminal, Opus 5.5 ahora; prueba Argon en trabajo legal, financiero y de contexto largo cuando abra.

Lado a lado

Gemini 4 ArgonOpus 5.5
EmpresaGoogle DeepMindAnthropic
Lanzamiento30 de septiembre de 2026 (solo programa Fairwind)22 de septiembre de 2026
Entrada / salida por millón$2 / $10 lanzamiento, $4 / $20 estándar$4 / $20
Entrada en caché por millón$0.10 lanzamiento, $0.20 estándar$0.20
Salida máxima1M de tokens128K tokens
Ventana de contexto—1M

Benchmarks

De la tabla de Gemini 4 Argon de Google. Google corrió cada modelo con su nivel de razonamiento más alto. Anthropic publica sus propias comparaciones, que pueden no coincidir.

BenchmarkGemini 4 ArgonOpus 5.5
Vals Index68.9%67.0%
AutomationBench51.3%42.5%
Vals Finance Agent v265.4%58.6%
Harvey's Legal Agent Benchmark19.6%3.8%
DeepSWE v1.177.9%74.2%
FrontierSWE v255.0%62.3%
Vibe Code Bench91.9%90.3%
Terminal-Bench 4.057.4%66.4%
PostTrainBench45.3%49.3%
Terminal-Bench Science 0.157.6%63.3%
LABBench 288.8%73.1%
RiemannBench76.0%69.6%
GraphWalks BFS (up to 128K)99.7%90.6%
GraphWalks BFS (256K-1M)84.2%66.8%
Agent's Last Exam39.5%38.2%
OSWorld-2.069.2%—
Chartography71.6%66.3%
LVBench91.7%83.7%
CWE-bench v168.0%67.0%

Argon gana en 14, Opus 5.5 en 4 y 0 terminan empatados.

Fuente: Google DeepMind: página de modelos Gemini

Costo por tarea de programación

Tamaño del códigoArgon (lanzamiento)Argon (estándar)Opus 5.5
Pequeño (< 10k líneas)$0.112$0.223$0.223
Mediano (10k-100k líneas)$0.249$0.498$0.498
Grande / monorepo (> 100k líneas)$0.594$1.188$1.188

Con 173 tareas al mes en código mediano: unos $43 con Argon a precio de lanzamiento ($86 a precio estándar) y $86 con Opus 5.5, con los mismos tokens para los dos.

Gemini 4 Argon: todos los detalles Compara todos los modelos en la calculadora

Cuál elegir

Preguntas frecuentes

¿Gemini 4 Argon es mejor que Opus 5.5?

En la tabla de Google, Argon le gana a Opus 5.5 en 14 de 18 benchmarks compartidos. Opus 5.5 va adelante en FrontierSWE v2, Terminal-Bench 4.0, PostTrainBench, Terminal-Bench Science 0.1. Cada empresa elige los benchmarks que le convienen, así que prueba con tu propio trabajo.

¿Cuál es más barato, Gemini 4 Argon u Opus 5.5?

Argon a precio de lanzamiento ($2 / $10). A precio estándar ($4 / $20) cuesta lo mismo que Opus 5.5.

¿Puedo usar Gemini 4 Argon en vez de Opus 5.5 hoy?

Solo si estás en el programa de seguridad Fairwind de Google. Los siguientes son los clientes de pago de la API de Gemini y los suscriptores de Google AI Ultra, sin fecha.

Página independiente, sin relación con Google, Anthropic ni Meta. Los benchmarks los publicó Google; no hicimos pruebas propias.