Тесты производительности
Тесты производительности и методология.
Как ChatGPT-6 соотносится с передовыми моделями на сегодняшний день — полная таблица, оговорки по каждому показателю и подробное описание методики.
Последнее обновление: сентябрь 2026 года
В большинстве сравнительных таблиц вам просто выдают вердикт без подтверждений. Эта таблица показывает цифры, затем объясняет, откуда они взялись, чего они не могут показать и почему бесплатный предварительный доступ искажает расчёты.
ChatGPT-6 — это предварительная версия с ранним доступом, поэтому воспринимайте её показатели как ориентировочные, а не окончательные — честное резюме звучит так: «качество уровня передовых моделей по цене, с которой не сравнится ни одна выпускаемая модель».
Полная таблица
Девять параметров, пять моделей, один бесплатный столбец.
| Metric | ChatGPT-6 | GPT-5.6 | Opus 5 | Gemini 3.7 | Grok 4.6 |
|---|---|---|---|---|---|
| Индекс интеллекта | 71* | 67 | 68 | 66 | 65 |
| Агентное программирование | 86* | 84 | 82 | 78 | 76 |
| Окно контекста | 400K | 400K | 1M | 2M | 500K |
| Максимальный вывод | 128K | 128K | 64K | 64K | 64K |
| Пропускная способность (tps) | 58* | 70 | 55 | 92 | 120 |
| Цена / 1M выходных токенов | $0 | $10 | $25 | $10 | $6 |
| Мультимодальность | |||||
| Открытые веса | |||||
| Бесплатное использование |
Составной балл по тестам на рассуждение, знания и математику (чем выше, тем лучше).
Ориентировочный балл агентного программирования — реальные задачи с несколькими файлами и инструментами (чем выше, тем лучше).
Максимальное количество токенов, которое модель может учитывать в рамках одного разговора.
Максимальный объём ответа, который модель создаёт за один вызов.
Медианная скорость вывода в токенах в секунду (чем выше, тем быстрее).
Публичная цена за миллион выходных токенов (чем ниже, тем дешевле).
Принимает изображения вместе с текстом.
Веса можно скачать и разместить на собственном сервере.
Сейчас доступно бесплатно.
Лоб в лоб
Хотите сосредоточенное сравнение один на один? Выберите пару моделей.
Методология
Индекс интеллектуальности — это сводный показатель на основе общедоступных тестов на рассуждение, знания и математику, созданный по аналогии с Artificial Analysis Intelligence Index. Агентное программирование отражает реальные задачи с несколькими файлами, выполняемые с использованием инструментов, а не изолированные фрагменты кода.
Контекстное окно, максимальный объём вывода, пропускная способность и цена — это данные, предоставленные провайдерами. Цена указана за один миллион выходных токенов; входные токены обычно дешевле и не отображаются, чтобы таблица оставалась удобной для чтения.
ChatGPT-6 находится на стадии предварительного тестирования с ранним доступом, поэтому его показатели (отмеченные *) являются оценками сообщества, а не данными из спецификации поставщика. Они будут меняться по мере настройки модели — мы обновляем эту страницу по мере появления более точных данных.
В этой области числа быстро меняются. Используйте это как ориентир при выборе модели, а не как официальный рейтинг результатов тестирования. Если сомневаетесь, проведите собственную оценку на собственных промптах.
Убедитесь сами
Цифры — это одно. Дайте ChatGPT-6 реальную задачу и оцените результат.