OpenAI retoma a liderança: o que o GPT-6 Astra muda na corrida entre os grandes modelos de IA
Treinado na plataforma Blackwell da Nvidia, o GPT-6 Astra como sistema supera concorrentes em testes de desempenho e reabre a disputa pela adoção de IA nas empresas
Nos últimos dois anos, a disputa entre os grandes laboratórios de inteligência artificial foi medida por duas métricas centrais: pontuação em testes de raciocínio e adoção no mercado corporativo. A Anthropic vinha consolidando espaço em ambas as frentes com a linha Claude, enquanto a OpenAI mantinha liderança expressiva no uso individual do ChatGPT. O lançamento do GPT-6 Astra, no início de setembro, altera o equilíbrio dessa corrida.
A mudança aparece no ARC-AGI-3, considerado um dos testes mais difíceis do setor por medir a capacidade de aprendizado em cenários inéditos, sem memorização prévia. Avaliado nas mesmas condições aplicadas aos concorrentes, o Astra registrou 62,7% de aproveitamento, mais que o dobro da pontuação do Claude Opus 5, da Anthropic, que marcou 30,2%. A geração anterior da própria OpenAI, o GPT-5.6 Sol, havia alcançado 7,8%.
“A IA entra num ambiente que nunca viu e precisa descobrir as regras sozinha. Cada versão costuma durar um ano até alguém chegar perto de resolver. Essa terceira versão tem seis meses de vida e o Astra praticamente destruiu o teste na primeira rodada”, afirma Harold Schultz, diretor de produto da Labrynth, plataforma de IA que atua com compliance e processos regulatórios nos EUA.

Parte da explicação está na base física do treinamento. O Astra é o primeiro modelo de grande porte inteiramente treinado sobre a arquitetura Blackwell, geração mais recente de processadores da Nvidia para data centers.
“Quando uma ferramenta nasce dentro dessa arquitetura, o salto é de outra ordem, porque a curva de capacidade do hardware é até quatro vezes maior que a da geração anterior. O Astra materializa essa mudança, e o rendimento apareceu exatamente onde era esperado”, explica Schultz.
Acompanhando esse ganho de potência, o sistema tornou-se também o primeiro da OpenAI a atingir o nível considerado “crítico” no framework interno de avaliação de riscos cibernéticos da empresa, classificação atribuída a tecnologias com alto grau de autonomia para analisar e interagir com infraestruturas protegidas.
A combinação entre ganho de desempenho e maturidade em cibersegurança recoloca a OpenAI na disputa pelo mercado corporativo. O ChatGPT sempre dominou a preferência do usuário individual, mas foi no ambiente de negócios, exigente em proteção de dados e tarefas complexas, que o Claude avançou ao longo do último ano.
“Nos meus testes, hoje não dá para comparar o que o Claude entrega com o que o Astra entrega; a diferença aparece no uso real, não só na planilha de benchmark. É isso que muda a conversa dentro das empresas. Com o Astra, a OpenAI volta para essa mesa com argumento de sobra”, conclui Schultz.