Gemini 4 Argon uzyskał 52,6 pkt w Intelligence Index w ustawieniu High, niemal tyle co GPT-6 Astra (52,7 pkt, Max). Claude Opus 5.5 w ustawieniu Max zdobył 57,6 pkt. To porównanie trzech modeli w jednym indeksie złożonym — nie uniwersalna ocena ich skuteczności we wszystkich zadaniach.
Argon, Astra i Opus w Intelligence Index
| Model | Ustawienie | Wynik Intelligence Index |
| Gemini 4 Argon | High | 52,6 pkt |
| GPT-6 Astra | Max | 52,7 pkt |
| Claude Opus 5.5 | Max | 57,6 pkt |
Różnica między Gemini 4 Argon a GPT-6 Astra wynosi 0,1 pkt. Claude Opus 5.5 uzyskał najwyższy wynik spośród tej trójki. Indeks łączy wyniki z dziesięciu ewaluacji, więc mówi o rezultacie w tym konkretnym zestawieniu, a nie o przewadze w każdym rodzaju pracy.
Wyniki benchmarków podane przez Google
Google podało, że Gemini 4 Argon uzyskał 77,9% w DeepSWE v1.1 oraz 68% w CWE-bench v1. Pierwszy wynik dotyczy benchmarku związanego z inżynierią oprogramowania, a drugi — usuwania podatności.
Google poinformowało także, że maksymalna liczba tokenów w odpowiedzi Argona wzrosła z 64 000 do 1 000 000.
Co wnosi praktyczna próba generowania?
W krótkiej serii promptów model generuje m.in. wizualizacje Golden Gate Bridge i Tower of Babel oraz przykłady związane z tworzeniem gry. Wyniki różnią się między zadaniami, więc te demonstracje pokazują konkretne generacje, a nie standaryzowany pomiar ogólnej jakości modelu.
Etapowy dostęp do Argona
30 września 2026 r. Google ogłosiło rozpoczęcie udostępniania Gemini 4 Argon wybranym zaufanym obrońcom cyberbezpieczeństwa w ramach programu Fairwind. W kolejnej fazie dostęp ma objąć deweloperów, firmy i konsumentów, począwszy od płatnych klientów API oraz subskrybentów Google AI Ultra. Więcej o ogłoszeniu i planie wdrażania opisaliśmy w osobnym materiale.