Benchmark

Benchmark e metodologia.

Come si posiziona ChatGPT-6 rispetto ai modelli di punta attuali — la tabella completa, le riserve dietro ogni numero e il metodo esatto con cui è stata elaborata.

Ultimo aggiornamento: settembre 2026

La maggior parte delle tabelle comparative ti consegna un verdetto senza prove. Questa stampa i numeri, poi ti spiega da dove provengono, cosa non possono dirti e perché un'anteprima gratuita altera i calcoli.

ChatGPT-6 è un'anteprima ad accesso anticipato, quindi considera i suoi dati indicativi e non definitivi — il riassunto onesto è "qualità da modello di frontiera a un prezzo che nessun modello a pagamento può eguagliare."

La tabella completa

Nove dimensioni, cinque modelli, una colonna gratuita.

Metric
ChatGPT-6
GPT-5.6
Opus 5
Gemini 3.7
Grok 4.6
Indice di intelligenza71*67686665
Codifica agentica86*84827876
Finestra di contesto400K400K1M2M500K
Output massimo128K128K64K64K64K
Velocità di elaborazione (tps)58*705592120
Prezzo / 1M output$0$10$25$10$6
Multimodale
Pesi aperti
Utilizzabile gratuitamente
Indice di intelligenza

Punteggio composito su benchmark di ragionamento, conoscenza e matematica (più alto è meglio).

Codifica agentica

Punteggio indicativo di codifica agentica — attività reali su più file con strumenti (più alto è meglio).

Finestra di contesto

Numero massimo di token a cui il modello può prestare attenzione in una singola conversazione.

Output massimo

Risposta più lunga che il modello genererà in una singola chiamata.

Velocità di elaborazione (tps)

Velocità mediana di output in token al secondo (più alto significa più veloce).

Prezzo / 1M output

Prezzo di listino per milione di token di output (più basso è più economico).

Multimodale

Accetta input di immagini oltre al testo.

Pesi aperti

I pesi possono essere scaricati e ospitati autonomamente.

Utilizzabile gratuitamente

Utilizzabile gratuitamente al momento.

Metodologia

L'Intelligence Index è un indice composito basato su benchmark pubblici di ragionamento, conoscenza e matematica, nello spirito dell'Artificial Analysis Intelligence Index. La programmazione agentica riflette attività reali su più file eseguite con strumenti, anziché frammenti isolati.

La finestra di contesto, l'output massimo, il throughput e il prezzo sono dati dichiarati dai provider. Il prezzo è la tariffa di listino per un milione di token di output; i token di input sono solitamente più economici e sono omessi per mantenere la tabella leggibile.

ChatGPT-6 è in anteprima ad accesso anticipato, quindi i suoi dati (contrassegnati da *) sono stime riportate dalla community e non dati di una scheda tecnica del fornitore. Cambieranno man mano che il modello verrà ottimizzato: aggiorniamo questa pagina quando emergono dati migliori.

I numeri cambiano rapidamente in questo settore. Usa questa guida indicativa per scegliere un modello, non come classifica definitiva dei benchmark. In caso di dubbi, esegui la tua valutazione sui tuoi prompt.

Verificalo di persona

I numeri sono una cosa. Affida a ChatGPT-6 un'attività reale e valuta l'output.

Apri la console