Gemini 4 Argon: cómo se compara el nuevo modelo de Google en precio y specs con GPT-6 Astra y Claude Opus 5.5
Google presentó Gemini 4 Argon como su modelo más potente, con capacidad para un millón de tokens de salida por sesión. Así se compara en precio y benchmarks con los modelos de frontera de OpenAI, Anthropic y con su propio Gemini 3 Pro.
Google lanzó en los últimos días Gemini 4 Argon, el primer modelo de su cuarta generación de inteligencia artificial y, según la propia empresa, el más potente que ha producido hasta ahora. El anuncio llega con una batería de benchmarks en los que Argon dice ganar o empatar en el primer puesto en 12 de 18 pruebas frente a los modelos de frontera de OpenAI y Anthropic, y con un cambio de énfasis que la cobertura especializada señala como más relevante que las cifras mismas: Google ya no vende a Gemini 4 como un chatbot más capaz, sino como un modelo pensado para sesiones de trabajo largas y en buena medida autónomas, con capacidad para generar hasta un millón de tokens de salida en una sola sesión. Las cifras de desempeño citadas a lo largo de esta nota provienen de cobertura especializada —Webreactiva y Xataka— y no de una publicación oficial de Google accesible para esta investigación.
Ese salto de escala es la pieza central del argumento de Google. Según la empresa, Gemini 4 Argon alcanza 77,9% en DeepSWE v1.1 —un benchmark de ingeniería de software de largo plazo— y 53 puntos en el Intelligence Index de Artificial Analysis, donde iguala a GPT-6 Astra, el modelo de frontera que OpenAI lanzó a comienzos de septiembre.
Xataka, sin embargo, introduce una cautela importante: contrapone los benchmarks oficiales con reportes internos de empleados de Google que describen un rendimiento "menos impresionante" en tareas reales de programación, algo que la compañía niega. Es el recordatorio habitual de que un benchmark mide lo que fue diseñado para medir, no necesariamente el desempeño que un usuario encuentra en producción.
El acceso, por ahora, es la limitación más concreta del lanzamiento. Gemini 4 Argon no está disponible como API pública ni dentro de la aplicación de Gemini: solo pueden probarlo las más de 650 organizaciones del programa Fairwind, equipos internos de Google y el gobierno de Estados Unidos, sin fecha anunciada para una apertura mayor. Eso significa que, a diferencia de lanzamientos anteriores de la familia, la comparación con la competencia es hoy más una comparación de hojas de especificaciones que de uso real disponible para cualquiera.
Donde sí hay números concretos y comparables es en el precio. Google fijó para Gemini 4 Argon una tarifa de lanzamiento de 2 dólares por millón de tokens de entrada y 10 por millón de salida, que subirá a 4 y 20 dólares una vez termine el período promocional —el mismo precio final que Anthropic fijó en septiembre para Claude Opus 5.5—. OpenAI cobra sensiblemente más por GPT-6 Astra en su tarifa estándar: 10 dólares de entrada y 50 de salida por millón de tokens.
El salto de Gemini 4 también se mide hacia adentro de la propia familia Google: Gemini 3 Pro, el modelo de la generación anterior, ofrece un máximo de salida de 65.536 tokens, frente al millón de tokens de salida por sesión de Gemini 4 Argon. Es esa diferencia de escala, más que el precio o los benchmarks, la que sostiene el argumento de Google de que Gemini 4 no es una mejora incremental de chat, sino un modelo diseñado para que un agente trabaje de forma sostenida y con mínima supervisión durante tareas largas.
El lanzamiento se da en medio de una sucesión apretada de modelos de frontera: Claude Opus 5.5 llegó el 22 de septiembre, GPT-6 Astra a comienzos del mismo mes, y ahora Gemini 4 Argon una semana después de Opus 5.5. Cada laboratorio presenta su modelo como el nuevo líder en algún subconjunto de benchmarks, lo que —más allá de las cifras puntuales de esta ronda— describe una carrera donde el liderazgo técnico se mide en semanas, no en meses, y donde la disponibilidad real para desarrolladores y usuarios suele llegar bastante después del anuncio inicial.
Fuentes consultadas
- Webreactiva — “Gemini 4 Argon: benchmarks, precio y por qué no puedes usarlo todavía” — 2026-10-02
- Xataka — “Gemini 4 arrasa en los benchmarks y vuelve a meter a Google en la carrera de la IA, el problema es precisamente los benchmarks” — 2026-10-02


