Evaluaciones comparativas

Evaluaciones comparativas y metodología.

Cómo se compara ChatGPT-6 con los modelos más avanzados actuales: la tabla completa, las salvedades detrás de cada número y exactamente cómo se elaboró.

Última actualización: septiembre de 2026

La mayoría de las tablas comparativas te dan un veredicto sin pruebas. Esta muestra los números y luego te dice de dónde vienen, qué no pueden decirte y por qué una vista previa gratuita altera los cálculos.

ChatGPT-6 es una vista previa de acceso anticipado, así que interpreta sus cifras como orientativas y no definitivas; el resumen honesto es "calidad de vanguardia a un precio que ningún modelo comercial puede igualar".

La tabla completa

Nueve ejes, cinco modelos, una columna gratuita.

Metric
ChatGPT-6
GPT-5.6
Opus 5
Gemini 3.7
Grok 4.6
Índice de inteligencia71*67686665
Programación agéntica86*84827876
Ventana de contexto400K400K1M2M500K
Salida máxima128K128K64K64K64K
Rendimiento (tps)58*705592120
Precio / 1M de salida$0$10$25$10$6
Multimodal
Pesos abiertos
Uso gratuito
Índice de inteligencia

Puntuación compuesta en pruebas de razonamiento, conocimiento y matemáticas (cuanto más alta, mejor).

Programación agéntica

Puntuación indicativa de programación agéntica: tareas reales con varios archivos y herramientas (cuanto más alta, mejor).

Ventana de contexto

Número máximo de tokens a los que el modelo puede atender en una sola conversación.

Salida máxima

Respuesta más larga que el modelo generará en una única llamada.

Rendimiento (tps)

Velocidad de salida mediana en tokens por segundo (cuanto más alta, más rápido).

Precio / 1M de salida

Precio de lista por millón de tokens de salida (cuanto más bajo, más barato).

Multimodal

Acepta entradas de imagen junto con texto.

Pesos abiertos

Los pesos se pueden descargar y alojar en servidores propios.

Uso gratuito

Se puede usar sin costo por ahora.

Metodología

El Índice de Inteligencia es una combinación de benchmarks públicos de razonamiento, conocimiento y matemáticas, inspirada en el Artificial Analysis Intelligence Index. La programación agéntica refleja tareas reales con varios archivos ejecutadas con herramientas, en lugar de fragmentos aislados.

La ventana de contexto, la salida máxima, el rendimiento y el precio son cifras reportadas por los proveedores. El precio corresponde a la tarifa de lista por cada millón de tokens de salida; los tokens de entrada suelen ser más baratos y se omiten para mantener la tabla legible.

ChatGPT-6 está en vista previa de acceso anticipado, por lo que sus cifras (marcadas con *) son estimaciones reportadas por la comunidad y no datos de una ficha técnica del proveedor. Cambiarán a medida que se ajuste el modelo; actualizamos esta página cuando aparecen datos más precisos.

Los números cambian rápidamente en este ámbito. Usa esto como una guía orientativa para elegir un modelo, no como una clasificación definitiva de benchmarks. En caso de duda, ejecuta tu propia evaluación con tus propios prompts.

Compruébalo por ti mismo

Los números son solo una parte. Dale a ChatGPT-6 una tarea real y evalúa el resultado.

Abrir la consola