Benchmarks
Benchmarks e metodologia.
Como o ChatGPT-6 se compara à vanguarda atual — a tabela completa, as ressalvas por trás de cada número e exatamente como tudo foi elaborado.
Última atualização: setembro de 2026
A maioria das tabelas comparativas entrega um veredito sem provas. Esta imprime os números e explica de onde eles vêm, o que não podem dizer e por que uma prévia gratuita distorce os cálculos.
ChatGPT-6 é uma prévia de acesso antecipado, então interprete seus números como indicativos, não definitivos — o resumo honesto é "qualidade de ponta a um preço que nenhum modelo em produção consegue igualar."
A tabela completa
Nove dimensões, cinco modelos, uma coluna gratuita.
| Metric | ChatGPT-6 | GPT-5.6 | Opus 5 | Gemini 3.7 | Grok 4.6 |
|---|---|---|---|---|---|
| Índice de inteligência | 71* | 67 | 68 | 66 | 65 |
| Programação agêntica | 86* | 84 | 82 | 78 | 76 |
| Janela de contexto | 400K | 400K | 1M | 2M | 500K |
| Saída máxima | 128K | 128K | 64K | 64K | 64K |
| Vazão (tps) | 58* | 70 | 55 | 92 | 120 |
| Preço / 1M de saída | $0 | $10 | $25 | $10 | $6 |
| Multimodal | |||||
| Pesos abertos | |||||
| Uso gratuito |
Pontuação composta em benchmarks de raciocínio, conhecimento e matemática (quanto maior, melhor).
Pontuação indicativa de programação agêntica — tarefas reais com vários arquivos e ferramentas (quanto maior, melhor).
Número máximo de tokens aos quais o modelo pode dar atenção em uma única conversa.
Maior resposta que o modelo gerará em uma única chamada.
Velocidade mediana de saída em tokens por segundo (quanto maior, mais rápido).
Preço de tabela por milhão de tokens de saída (quanto menor, mais barato).
Aceita entrada de imagens junto com texto.
Os pesos podem ser baixados e hospedados localmente.
Pode ser usado sem custo no momento.
Confronto direto
Quer uma análise focada, um a um? Escolha um confronto.
Metodologia
O Índice de Inteligência é uma combinação de benchmarks públicos de raciocínio, conhecimento e matemática, inspirado no Artificial Analysis Intelligence Index. A programação agentiva reflete tarefas reais com vários arquivos, executadas com ferramentas, em vez de trechos isolados.
A janela de contexto, a saída máxima, a taxa de processamento e o preço são dados informados pelos provedores. O preço é a tarifa de tabela por um milhão de tokens de saída; os tokens de entrada geralmente são mais baratos e foram omitidos para manter a tabela legível.
ChatGPT-6 está em prévia de acesso antecipado, portanto seus números (marcados com *) são estimativas informadas pela comunidade, e não dados de uma ficha técnica do fornecedor. Eles mudarão conforme o modelo for ajustado — atualizamos esta página à medida que surgem dados melhores.
Os números mudam rapidamente neste setor. Use isto como um guia geral para escolher um modelo, não como um ranking definitivo de benchmarks. Em caso de dúvida, execute sua própria avaliação com seus próprios prompts.
Veja por si mesmo
Números são uma coisa. Dê uma tarefa real ao ChatGPT-6 e avalie o resultado.