Testy porównawcze
Testy porównawcze i metodologia.
Jak ChatGPT-6 wypada na tle obecnej czołówki — pełna tabela, zastrzeżenia dotyczące każdej liczby oraz dokładny opis sposobu jej opracowania.
Ostatnia aktualizacja: wrzesień 2026
Większość tabel porównawczych podaje werdykt bez żadnych dowodów. Ta pokazuje liczby, a następnie wyjaśnia, skąd pochodzą, czego nie mówią i dlaczego bezpłatny podgląd zmienia obliczenia.
ChatGPT-6 jest wersją testową we wczesnym dostępie, więc traktuj jego wyniki jako orientacyjne, a nie ostateczne — uczciwe podsumowanie brzmi: "jakość klasy frontier w cenie, której nie może dorównać żaden model dostępny w ofercie."
Pełna tabela
Dziewięć osi, pięć modeli, jedna bezpłatna kolumna.
| Metric | ChatGPT-6 | GPT-5.6 | Opus 5 | Gemini 3.7 | Grok 4.6 |
|---|---|---|---|---|---|
| Indeks inteligencji | 71* | 67 | 68 | 66 | 65 |
| Kodowanie agentowe | 86* | 84 | 82 | 78 | 76 |
| Okno kontekstowe | 400K | 400K | 1M | 2M | 500K |
| Maks. długość odpowiedzi | 128K | 128K | 64K | 64K | 64K |
| Przepustowość (tps) | 58* | 70 | 55 | 92 | 120 |
| Cena / 1M tokenów wyjściowych | $0 | $10 | $25 | $10 | $6 |
| Multimodalność | |||||
| Otwarte wagi | |||||
| Bezpłatny dostęp |
Łączny wynik dla testów rozumowania, wiedzy i matematyki (wyższy wynik jest lepszy).
Orientacyjny wynik kodowania agentowego — rzeczywiste zadania obejmujące wiele plików i korzystanie z narzędzi (wyższy wynik jest lepszy).
Maksymalna liczba tokenów, na których model może operować w ramach jednej rozmowy.
Najdłuższa odpowiedź, jaką model wygeneruje w jednym wywołaniu.
Mediana szybkości generowania w tokenach na sekundę (wyższa wartość oznacza większą szybkość).
Cena katalogowa za milion tokenów wyjściowych (niższa cena jest korzystniejsza).
Obsługuje obrazy wraz z tekstem.
Wagi można pobrać i hostować samodzielnie.
Obecnie można używać bezpłatnie.
Bezpośrednie porównanie
Szukasz skoncentrowanego porównania jeden na jeden? Wybierz zestawienie.
Metodologia
Indeks inteligencji to złożony wskaźnik oparty na publicznych testach rozumowania, wiedzy i matematyki, inspirowany indeksem Artificial Analysis Intelligence Index. Programowanie agentowe odzwierciedla rzeczywiste zadania obejmujące wiele plików i wykonywane za pomocą narzędzi, a nie odizolowane fragmenty kodu.
Rozmiar okna kontekstu, maksymalna długość odpowiedzi, przepustowość i cena to dane podawane przez dostawców. Cena oznacza stawkę za milion tokenów wyjściowych; tokeny wejściowe są zwykle tańsze i pomijamy je, aby tabela była bardziej czytelna.
ChatGPT-6 jest dostępny we wczesnej wersji testowej, dlatego jego dane (oznaczone symbolem *) to szacunki zgłoszone przez społeczność, a nie dane z karty specyfikacji producenta. Będą się zmieniać w miarę dostrajania modelu — aktualizujemy tę stronę, gdy pojawiają się lepsze dane.
Liczby szybko się zmieniają. Potraktuj to jako ogólny przewodnik przy wyborze modelu, a nie oficjalny ranking wyników testów. W razie wątpliwości przeprowadź własną ewaluację na własnych promptach.
Przekonaj się samodzielnie
Liczby to jedno. Zleć ChatGPT-6 prawdziwe zadanie i oceń wynik.