Testy porównawcze

Testy porównawcze i metodologia.

Jak ChatGPT-6 wypada na tle obecnej czołówki — pełna tabela, zastrzeżenia dotyczące każdej liczby oraz dokładny opis sposobu jej opracowania.

Ostatnia aktualizacja: wrzesień 2026

Większość tabel porównawczych podaje werdykt bez żadnych dowodów. Ta pokazuje liczby, a następnie wyjaśnia, skąd pochodzą, czego nie mówią i dlaczego bezpłatny podgląd zmienia obliczenia.

ChatGPT-6 jest wersją testową we wczesnym dostępie, więc traktuj jego wyniki jako orientacyjne, a nie ostateczne — uczciwe podsumowanie brzmi: "jakość klasy frontier w cenie, której nie może dorównać żaden model dostępny w ofercie."

Pełna tabela

Dziewięć osi, pięć modeli, jedna bezpłatna kolumna.

Metric
ChatGPT-6
GPT-5.6
Opus 5
Gemini 3.7
Grok 4.6
Indeks inteligencji71*67686665
Kodowanie agentowe86*84827876
Okno kontekstowe400K400K1M2M500K
Maks. długość odpowiedzi128K128K64K64K64K
Przepustowość (tps)58*705592120
Cena / 1M tokenów wyjściowych$0$10$25$10$6
Multimodalność
Otwarte wagi
Bezpłatny dostęp
Indeks inteligencji

Łączny wynik dla testów rozumowania, wiedzy i matematyki (wyższy wynik jest lepszy).

Kodowanie agentowe

Orientacyjny wynik kodowania agentowego — rzeczywiste zadania obejmujące wiele plików i korzystanie z narzędzi (wyższy wynik jest lepszy).

Okno kontekstowe

Maksymalna liczba tokenów, na których model może operować w ramach jednej rozmowy.

Maks. długość odpowiedzi

Najdłuższa odpowiedź, jaką model wygeneruje w jednym wywołaniu.

Przepustowość (tps)

Mediana szybkości generowania w tokenach na sekundę (wyższa wartość oznacza większą szybkość).

Cena / 1M tokenów wyjściowych

Cena katalogowa za milion tokenów wyjściowych (niższa cena jest korzystniejsza).

Multimodalność

Obsługuje obrazy wraz z tekstem.

Otwarte wagi

Wagi można pobrać i hostować samodzielnie.

Bezpłatny dostęp

Obecnie można używać bezpłatnie.

Metodologia

Indeks inteligencji to złożony wskaźnik oparty na publicznych testach rozumowania, wiedzy i matematyki, inspirowany indeksem Artificial Analysis Intelligence Index. Programowanie agentowe odzwierciedla rzeczywiste zadania obejmujące wiele plików i wykonywane za pomocą narzędzi, a nie odizolowane fragmenty kodu.

Rozmiar okna kontekstu, maksymalna długość odpowiedzi, przepustowość i cena to dane podawane przez dostawców. Cena oznacza stawkę za milion tokenów wyjściowych; tokeny wejściowe są zwykle tańsze i pomijamy je, aby tabela była bardziej czytelna.

ChatGPT-6 jest dostępny we wczesnej wersji testowej, dlatego jego dane (oznaczone symbolem *) to szacunki zgłoszone przez społeczność, a nie dane z karty specyfikacji producenta. Będą się zmieniać w miarę dostrajania modelu — aktualizujemy tę stronę, gdy pojawiają się lepsze dane.

Liczby szybko się zmieniają. Potraktuj to jako ogólny przewodnik przy wyborze modelu, a nie oficjalny ranking wyników testów. W razie wątpliwości przeprowadź własną ewaluację na własnych promptach.

Przekonaj się samodzielnie

Liczby to jedno. Zleć ChatGPT-6 prawdziwe zadanie i oceń wynik.

Otwórz konsolę