Evaluaciones comparativas
Evaluaciones comparativas y metodología.
Cómo se compara ChatGPT-6 con los modelos más avanzados actuales: la tabla completa, las salvedades detrás de cada número y exactamente cómo se elaboró.
Última actualización: septiembre de 2026
La mayoría de las tablas comparativas te dan un veredicto sin pruebas. Esta muestra los números y luego te dice de dónde vienen, qué no pueden decirte y por qué una vista previa gratuita altera los cálculos.
ChatGPT-6 es una vista previa de acceso anticipado, así que interpreta sus cifras como orientativas y no definitivas; el resumen honesto es "calidad de vanguardia a un precio que ningún modelo comercial puede igualar".
La tabla completa
Nueve ejes, cinco modelos, una columna gratuita.
| Metric | ChatGPT-6 | GPT-5.6 | Opus 5 | Gemini 3.7 | Grok 4.6 |
|---|---|---|---|---|---|
| Índice de inteligencia | 71* | 67 | 68 | 66 | 65 |
| Programación agéntica | 86* | 84 | 82 | 78 | 76 |
| Ventana de contexto | 400K | 400K | 1M | 2M | 500K |
| Salida máxima | 128K | 128K | 64K | 64K | 64K |
| Rendimiento (tps) | 58* | 70 | 55 | 92 | 120 |
| Precio / 1M de salida | $0 | $10 | $25 | $10 | $6 |
| Multimodal | |||||
| Pesos abiertos | |||||
| Uso gratuito |
Puntuación compuesta en pruebas de razonamiento, conocimiento y matemáticas (cuanto más alta, mejor).
Puntuación indicativa de programación agéntica: tareas reales con varios archivos y herramientas (cuanto más alta, mejor).
Número máximo de tokens a los que el modelo puede atender en una sola conversación.
Respuesta más larga que el modelo generará en una única llamada.
Velocidad de salida mediana en tokens por segundo (cuanto más alta, más rápido).
Precio de lista por millón de tokens de salida (cuanto más bajo, más barato).
Acepta entradas de imagen junto con texto.
Los pesos se pueden descargar y alojar en servidores propios.
Se puede usar sin costo por ahora.
Enfrentamiento directo
¿Quieres una comparación enfocada, uno a uno? Elige un enfrentamiento.
Metodología
El Índice de Inteligencia es una combinación de benchmarks públicos de razonamiento, conocimiento y matemáticas, inspirada en el Artificial Analysis Intelligence Index. La programación agéntica refleja tareas reales con varios archivos ejecutadas con herramientas, en lugar de fragmentos aislados.
La ventana de contexto, la salida máxima, el rendimiento y el precio son cifras reportadas por los proveedores. El precio corresponde a la tarifa de lista por cada millón de tokens de salida; los tokens de entrada suelen ser más baratos y se omiten para mantener la tabla legible.
ChatGPT-6 está en vista previa de acceso anticipado, por lo que sus cifras (marcadas con *) son estimaciones reportadas por la comunidad y no datos de una ficha técnica del proveedor. Cambiarán a medida que se ajuste el modelo; actualizamos esta página cuando aparecen datos más precisos.
Los números cambian rápidamente en este ámbito. Usa esto como una guía orientativa para elegir un modelo, no como una clasificación definitiva de benchmarks. En caso de duda, ejecuta tu propia evaluación con tus propios prompts.
Compruébalo por ti mismo
Los números son solo una parte. Dale a ChatGPT-6 una tarea real y evalúa el resultado.