No Intelligence Index, Gemini 4 Argon marcou 52,6 pontos na configuração High, quase o mesmo resultado do GPT-6 Astra (Max), com 52,7. Claude Opus 5.5 (Max) ficou acima, com 57,6. O índice reúne dez avaliações distintas em uma pontuação composta.
A matéria anterior do NeoTeo sobre os relatos de dificuldades práticas e a resposta do Google trata desse contexto; aqui, o foco são as pontuações e os exemplos de geração.
Argon, Astra e Opus no Intelligence Index
| Modelo | Configuração | Pontuação no Intelligence Index |
| Gemini 4 Argon | High | 52,6 pontos |
| GPT-6 Astra | Max | 52,7 pontos |
| Claude Opus 5.5 | Max | 57,6 pontos |
Argon e Astra ficam praticamente empatados nesse índice, enquanto Claude Opus 5.5 alcança uma pontuação maior. Como a nota combina dez avaliações, ela resume um conjunto de tarefas em vez de medir uma única habilidade.
Resultados de benchmark divulgados pelo Google
O Google informou que Gemini 4 Argon marcou 77,9% em DeepSWE v1.1, um benchmark de engenharia de software, e 68% em CWE-bench v1, voltado à correção de vulnerabilidades. São resultados de avaliações diferentes, publicados pela própria empresa.
A cobertura anterior do NeoTeo contextualiza relatos sobre tarefas práticas de programação e a resposta do Google.
O que um teste prático de geração acrescenta
Uma sequência de prompts para geração 3D percorre exemplos como a Golden Gate Bridge, ilhas e a Torre de Babel. As saídas variam de um pedido para outro: observar uma geração isolada não resume a consistência ao longo de diferentes prompts.
Acesso inicial por etapas
Em 30 de setembro, o Google informou que Gemini 4 Argon estava sendo liberado a defensores cibernéticos confiáveis selecionados por meio do programa Fairwind. A empresa planejava ampliar o acesso a desenvolvedores, empresas e consumidores, começando por clientes pagos da API e assinantes do Google AI Ultra.