Google presenta Gemini 4 Argon, su nueva apuesta de IA para programación y tareas empresariales

Google presenta Gemini 4 Argon, su nueva apuesta de IA para programación y tareas empresariales

Imagen para ayudar a comprender el artículo

Google presentó el 30 de septiembre de 2026 Gemini 4 Argon, un nuevo modelo de inteligencia artificial orientado a tareas complejas de ingeniería de software, gestión de conocimiento empresarial —incluidos los ámbitos jurídico y financiero— y defensa de la ciberseguridad.

El anuncio fue publicado a nombre de Koray Kavukcuoglu, vicepresidente sénior de Google DeepMind y arquitecto jefe de inteligencia artificial de Google. La compañía sostiene que Argon ofrece un rendimiento de primer nivel, aunque los resultados difundidos muestran diferencias importantes según el tipo de evaluación.

Ventaja en software, video y automatización

Según Google, Gemini 4 Argon obtuvo un 77,9% en DeepSWE v1.1, una prueba centrada en ingeniería de software. En la comparación publicada por VentureBeat, Claude Opus 5.5 alcanzó un 74,2% y GPT-6 Astra, un 74,1%. Google también situó a Argon en el primer puesto de AutomationBench, dedicado a la automatización de tareas, con un 51,3%.

En LVBench, un indicador de capacidades relacionadas con video, Argon registró un 91,7%, frente al 87,5% de GPT-6 Astra y el 83,7% de Claude Opus 5.5, de acuerdo con las cifras recogidas por VentureBeat. En el benchmark Legal Agent de Harvey, Argon consiguió un 19,6%, por encima del 5,4% de GPT-6 Astra y el 3,8% de Claude Opus 5.5.

Resultados desiguales frente a sus competidores

Argon no encabezó todas las pruebas de desarrollo. En FrontierSWE v2, GPT-6 Astra logró un 65,5%, frente al 55% del modelo de Google. Astra también se impuso en Terminal-Bench Science 0.1, con un 68,1% frente al 57,6% de Argon. En Terminal-bench 4.0, Claude Opus 5.5 obtuvo un 66,4%, mientras que Argon quedó en un 57,4%.

En la evaluación de ciberseguridad CWE-bench v1, Google informó que Argon y 3.8 Flash Cyber compartieron el primer puesto con un 68%. La empresa prevé ofrecer una versión de Argon sin las barreras de seguridad cibernética habituales a organizaciones de defensa consideradas confiables y a sus propios equipos internos.

Primer lugar en el índice de Vals AI

La firma independiente Vals AI colocó a Gemini 4 Argon en el primer puesto de su índice, entre 41 modelos, con una puntuación del 68,90% y un costo de 15,68 dólares por prueba. Claude Sonnet 5.5 obtuvo un 67,04% y un costo de 21,34 dólares; Claude Opus 5.5, un 66,97% y 32,14 dólares; y Claude Fable 5.1, un 65,83%.

Vals AI detalló para Argon una precisión del 68,90% con un margen de ±0,97 y una latencia de 46 minutos y 33 segundos. El modelo alcanzó el 100% en el benchmark IOI, empatado con GPT-6 Astra, y quedó segundo en Vibe Code Bench y Code Migration.

En Arena, Argon ocupó el primer lugar de la clasificación de texto con la categoría “High”. Sin embargo, terminó octavo en la evaluación Best Overall de Top 10 Agents, con un 7,92%. En el apartado Pareto Optimal Models figura con ese mismo nivel de rendimiento y un costo de 0,62 dólares por tarea.

Un millón de tokens y precio promocional

Google anunció que amplió el límite de salida de Argon desde 64.000 hasta un millón de tokens. No obstante, Vals AI consigna una ventana de contexto de un millón de tokens y una salida máxima de 262.000, una diferencia respecto de la información oficial.

Durante el lanzamiento, Google cobrará 2 dólares por cada millón de tokens de entrada y 10 dólares por cada millón de tokens de salida. Las entradas almacenadas en caché tendrán un descuento del 95%. Tras el periodo inicial, las tarifas subirán a 4 y 20 dólares, respectivamente, los mismos precios estándar indicados por Vals AI. VentureBeat calculó que la tarifa promocional equivale a una quinta parte del precio de API publicado para GPT-6 Astra.

Gemini 4 Argon todavía no está disponible de forma general. Su distribución comenzó gradualmente mediante el programa Fairwind para determinadas organizaciones confiables de ciberdefensa. Google planea ampliar después el acceso a desarrolladores, empresas y consumidores, comenzando por clientes de pago de su API y suscriptores de Google AI Ultra. Hasta que se habilite una disponibilidad más amplia, la mayoría de los clientes tendrá que esperar.

Source: Original Korean article - Trendy News Korea

Comentarios