Benchmark
Benchmark e metodologia.
Come si posiziona ChatGPT-6 rispetto ai modelli di punta attuali — la tabella completa, le riserve dietro ogni numero e il metodo esatto con cui è stata elaborata.
Ultimo aggiornamento: settembre 2026
La maggior parte delle tabelle comparative ti consegna un verdetto senza prove. Questa stampa i numeri, poi ti spiega da dove provengono, cosa non possono dirti e perché un'anteprima gratuita altera i calcoli.
ChatGPT-6 è un'anteprima ad accesso anticipato, quindi considera i suoi dati indicativi e non definitivi — il riassunto onesto è "qualità da modello di frontiera a un prezzo che nessun modello a pagamento può eguagliare."
La tabella completa
Nove dimensioni, cinque modelli, una colonna gratuita.
| Metric | ChatGPT-6 | GPT-5.6 | Opus 5 | Gemini 3.7 | Grok 4.6 |
|---|---|---|---|---|---|
| Indice di intelligenza | 71* | 67 | 68 | 66 | 65 |
| Codifica agentica | 86* | 84 | 82 | 78 | 76 |
| Finestra di contesto | 400K | 400K | 1M | 2M | 500K |
| Output massimo | 128K | 128K | 64K | 64K | 64K |
| Velocità di elaborazione (tps) | 58* | 70 | 55 | 92 | 120 |
| Prezzo / 1M output | $0 | $10 | $25 | $10 | $6 |
| Multimodale | |||||
| Pesi aperti | |||||
| Utilizzabile gratuitamente |
Punteggio composito su benchmark di ragionamento, conoscenza e matematica (più alto è meglio).
Punteggio indicativo di codifica agentica — attività reali su più file con strumenti (più alto è meglio).
Numero massimo di token a cui il modello può prestare attenzione in una singola conversazione.
Risposta più lunga che il modello genererà in una singola chiamata.
Velocità mediana di output in token al secondo (più alto significa più veloce).
Prezzo di listino per milione di token di output (più basso è più economico).
Accetta input di immagini oltre al testo.
I pesi possono essere scaricati e ospitati autonomamente.
Utilizzabile gratuitamente al momento.
Confronto diretto
Vuoi un'analisi mirata, uno contro uno? Scegli un confronto.
Metodologia
L'Intelligence Index è un indice composito basato su benchmark pubblici di ragionamento, conoscenza e matematica, nello spirito dell'Artificial Analysis Intelligence Index. La programmazione agentica riflette attività reali su più file eseguite con strumenti, anziché frammenti isolati.
La finestra di contesto, l'output massimo, il throughput e il prezzo sono dati dichiarati dai provider. Il prezzo è la tariffa di listino per un milione di token di output; i token di input sono solitamente più economici e sono omessi per mantenere la tabella leggibile.
ChatGPT-6 è in anteprima ad accesso anticipato, quindi i suoi dati (contrassegnati da *) sono stime riportate dalla community e non dati di una scheda tecnica del fornitore. Cambieranno man mano che il modello verrà ottimizzato: aggiorniamo questa pagina quando emergono dati migliori.
I numeri cambiano rapidamente in questo settore. Usa questa guida indicativa per scegliere un modello, non come classifica definitiva dei benchmark. In caso di dubbi, esegui la tua valutazione sui tuoi prompt.
Verificalo di persona
I numeri sono una cosa. Affida a ChatGPT-6 un'attività reale e valuta l'output.