Google presentó Gemini 4 Argon, su nuevo modelo de inteligencia artificial, con resultados que lo colocan al nivel de OpenAI y Anthropic en los principales benchmarks internacionales. Según Artificial Analysis, el modelo obtuvo 53 puntos en el Intelligence Index, igualando al GPT‑6 Astra, y superó a competidores como Opus 5.5 y Fable 5.1 en pruebas internas de la compañía. Estas cifras sugieren que Google vuelve a ser un actor dominante en la carrera por los modelos de frontera.
Sin embargo, Gemini 4 aún no está disponible para el público general. La empresa lo ha lanzado solo a un grupo limitado de “probadores de confianza” y a especialistas en ciberseguridad mediante el programa Fairwind. Además, el modelo está bajo revisión del gobierno de EE. UU., un paso que se ha vuelto habitual para evitar bloqueos regulatorios que podrían frenar su adopción masiva.
Las primeras impresiones de empleados de Google, recogidas por Bloomberg, revelan una visión mixta. Mientras que las métricas de benchmark son sobresalientes, algunos internos reportan que el modelo no rinde igual de bien en tareas de programación compleja. Sundar Pichai, CEO de la compañía, defendió el desempeño, asegurando que los equipos que lo usan a diario obtienen resultados positivos. La disparidad entre pruebas controladas y usos reales sigue siendo un punto de debate entre los expertos.
Los benchmarks, aunque útiles, representan escenarios idealizados. En la práctica, los desarrolladores trabajan con repositorios extensos, dependencias variadas y documentación incompleta, lo que puede afectar el rendimiento de cualquier IA. Por ello, la verdadera medida del éxito de Gemini 4 dependerá de su capacidad para adaptarse a entornos reales y a las necesidades específicas de cada usuario.
Un aspecto destacado es la reducción de alucinaciones. Artificial Analysis indica que Gemini 4 presenta una tasa del 15% en la prueba AA‑Omniscience, frente al 50% de GPT‑6 Astra. El modelo tiende a responder “no lo sé” cuando carece de información, lo que disminuye respuestas inventadas pero también requiere que los usuarios interpreten la falta de respuesta como una limitación del modelo.
Google también busca competir en precio. Inicialmente, Gemini 4 se ofrecerá a 0.02 dólares por millón de tokens, lo que representa un 40% menos que GPT‑6 Astra. La compañía ha anunciado que este precio promocional será temporal y que luego se ajustará a 0.04 dólares, lo que podría impactar su adopción en proyectos de gran escala. Se espera que futuras versiones, como una variante “Flash”, ayuden a equilibrar costo y rendimiento.
En conclusión, Gemini 4 Argon marca un regreso contundente de Google al escenario de IA de alto rendimiento, pero su éxito dependerá de la validación en entornos productivos, la gestión de costos y la aceptación de los usuarios frente a sus limitaciones prácticas.
Fuente: Xataka