Gemini 4 arrasa en los benchmarks y vuelve a meter a Google en la carrera de la IA. El problema son precisamente los benchmarks
Gemini 4 “Argon” vuelve a colocar a Google en la conversación de los modelos “frontera”, pero el debate se centra en los benchmarks y en su traducción al uso real. Según datos citados por la publicación, Artificial Analysis otorga a Gemini 4 53 puntos en el Intelligence Index, el mismo valor que GPT-6 Astra, mientras que en pruebas internas Google asegura que Argon supera a Opus 5.5 y Fable 5.1 en varios tests. Pese a ello, el modelo aún no se libera masivamente: primero llegará a “probadores de confianza” y especialistas de ciberseguridad por Fairwind, y también está bajo análisis del Gobierno de Estados Unidos. Además, se menciona una diferencia relevante en alucinaciones: 15% para Argon frente al 50% para Astra en una prueba, aunque con mayor precisión para Astra.







