Navegación
AI BENCHY
Advertise here

AI BENCHY Compare

OpenAI: GPT-5 Nano vs xAI: Grok 4.20

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-05-10

Métrica GPT-5 Nano GPT-5 Nano medium Lanzamiento: 2025-08-07 Grok 4.20 Grok 4.20 none Lanzamiento: 2026-03-31
Puntuación 6.2 5.4
Rango #85 #115
Fiabilidad 10.0 N/D
Consistencia 7.0 9.5
Pruebas correctas
Tasa de aciertos por intento 57.9% 35.2%
Pruebas inestables 7 1
Ejecuciones totales 57 54
Costo por resultado 0.856 1.574
Costo total $0.069 $0.095
Precio de entrada $0.050 / 1M $1.250 / 1M
Precio de salida $0.400 / 1M $2.500 / 1M
Tokens de salida 5,214 1,967
Tokens de razonamiento 162,432 0
Tiempo de respuesta (promedio) 42.13s 1.11s
Tiempo de respuesta (máximo) 204.02s 6.04s
Tiempo de respuesta (total) 505.59s 20.02s

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Trucos anti-IA Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
GPT-5 Nano 6.5 7.9 58.3% 1 25.50s 1,221 21,184
Grok 4.20 4.8 10.0 25.0% 0 501ms 267 0
Programación Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
GPT-5 Nano 6.7 3.5 66.7% 1 40.73s 480 12,992
Grok 4.20 3.4 9.3 0.0% 0 1.22s 312 0
Combinado Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
GPT-5 Nano 10.0 10.0 100.0% 0 65.96s 578 17,984
Grok 4.20 3.0 10.0 0.0% 0 6.04s 282 0
Análisis y extracción de datos Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
GPT-5 Nano 3.7 1.7 50.0% 2 21.42s 453 10,560
Grok 4.20 10.0 10.0 100.0% 0 522ms 207 0
Específico del dominio Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
GPT-5 Nano 5.2 4.4 55.6% 2 204.02s 237 64,448
Grok 4.20 3.0 10.0 0.0% 0 687ms 325 0
Inteligencia general Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
GPT-5 Nano 4.1 10.0 0.0% 0 17.51s 202 4,608
Grok 4.20 4.8 10.0 0.0% 0 659ms 83 0
Seguimiento de instrucciones Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
GPT-5 Nano 9.8 10.0 100.0% 0 11.90s 382 4,096
Grok 4.20 6.3 10.0 50.0% 0 455ms 60 0
Resolución de acertijos Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
GPT-5 Nano 5.3 7.2 44.4% 1 19.81s 869 13,440
Grok 4.20 5.3 7.2 44.4% 1 487ms 242 0
Llamada de herramientas Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
GPT-5 Nano 10.0 10.0 100.0% 0 33.30s 558 6,976
Grok 4.20 10.0 10.0 100.0% 0 4.63s 189 0
Cultura general Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
GPT-5 Nano 3.0 10.0 0.0% 0 20.13s 234 6,144
Grok 4.20 - - - - - - - -

Comparación rápida

Cambiar par de comparación