No Intelligence Index, Gemini 4 Argon marcou 52,6 pontos na configuração High, quase o mesmo resultado do GPT-6 Astra (Max), com 52,7. Claude Opus 5.5 (Max) ficou acima, com 57,6. O índice reúne dez avaliações distintas em uma pontuação composta.

A matéria anterior do NeoTeo sobre os relatos de dificuldades práticas e a resposta do Google trata desse contexto; aqui, o foco são as pontuações e os exemplos de geração.

Argon, Astra e Opus no Intelligence Index

ModeloConfiguraçãoPontuação no Intelligence Index
Gemini 4 ArgonHigh52,6 pontos
GPT-6 AstraMax52,7 pontos
Claude Opus 5.5Max57,6 pontos

Argon e Astra ficam praticamente empatados nesse índice, enquanto Claude Opus 5.5 alcança uma pontuação maior. Como a nota combina dez avaliações, ela resume um conjunto de tarefas em vez de medir uma única habilidade.

Resultados de benchmark divulgados pelo Google

O Google informou que Gemini 4 Argon marcou 77,9% em DeepSWE v1.1, um benchmark de engenharia de software, e 68% em CWE-bench v1, voltado à correção de vulnerabilidades. São resultados de avaliações diferentes, publicados pela própria empresa.

A cobertura anterior do NeoTeo contextualiza relatos sobre tarefas práticas de programação e a resposta do Google.

O que um teste prático de geração acrescenta

Sequência de prompts de geração 3D, com exemplos visuais que variam de uma solicitação para outra.

Uma sequência de prompts para geração 3D percorre exemplos como a Golden Gate Bridge, ilhas e a Torre de Babel. As saídas variam de um pedido para outro: observar uma geração isolada não resume a consistência ao longo de diferentes prompts.

Acesso inicial por etapas

Em 30 de setembro, o Google informou que Gemini 4 Argon estava sendo liberado a defensores cibernéticos confiáveis selecionados por meio do programa Fairwind. A empresa planejava ampliar o acesso a desenvolvedores, empresas e consumidores, começando por clientes pagos da API e assinantes do Google AI Ultra.