Navegación
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Modelos comparados

Comparación benchmark Grok 4.20 (medium) vs Grok 4.20 Beta (medium) vs Grok 4.3 (medium): Grok 4.3 (medium) lidera en Puntuación con 7.0. Grok 4.20 (medium) lidera en Fiabilidad con 10.0. Grok 4.3 (medium) tiene el Costo total más bajo con $0.741. Grok 4.20 Beta (medium) es el más rápido con 9.75s.

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-09-10

Modelos comparados

Rango
#145
Total de tokens de salida
270,259
Tiempo de respuesta (promedio)
32.56s
Costo total
$0.805
Rango
#210
Total de tokens de salida
93,212
Tiempo de respuesta (promedio)
9.75s
Costo total
$0.750
Rango
#139
Total de tokens de salida
225,904
Tiempo de respuesta (promedio)
44.21s
Costo total
$0.741
Modelo recomendado Grok 4.3 (medium)

Tiene la puntuación más alta en esta comparación (7.0) y el mejor equilibrio general entre coste y tiempo de respuesta en los 3 modelos.

Comparación detallada

Métrica Grok 4.20 Grok 4.20 medium Lanzamiento: 2026-03-31 Grok 4.20 Beta Grok 4.20 Beta medium Lanzamiento: 2026-03-12 Grok 4.3 Grok 4.3 medium Lanzamiento: 2026-05-01
Puntuación 7.0 6.0 7.0
Rango #145 #210 #139
Fiabilidad 10.0 N/D 10.0
Consistencia 8.2 7.8 8.2
Intentos 66/66 52/66 66/66
Pruebas correctas
Tasa de aciertos por intento 60.6% 66.7% 66.7%
Pruebas inestables 5 1 5
Ejecuciones totales 66 52 66
Costo por resultado 10.365 4.505 6.168
Costo total $0.805 $0.750 $0.741
Precio de entrada $1.250 / 1M $5.805 / 1M $1.250 / 1M
Precio de salida $2.500 / 1M $5.805 / 1M $2.500 / 1M
Total de tokens de entrada 102,986 35,955 140,244
Tokens de salida 5,860 1,647 13,739
Tokens de razonamiento 264,399 91,565 212,165
Tiempo de respuesta (promedio) 32.56s 9.75s 44.21s
Tiempo de respuesta (máximo) 199.66s 31.36s 216.69s
Tiempo de respuesta (total) 716.36s 175.48s 972.64s
Parámetros ~1T en total (~100B activos) ~1T en total (~100B activos) ~1.5T en total (~150B activos)
Disponibilidad Código cerrado Código cerrado Código cerrado

Generación showcase de modelos

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#145 SpaceXAI: Grok 4.20

medium
Coste
$0.041
Tiempo
110.3s
Tokens
16,336 tok

#210 Grok 4.20 Beta

medium
Coste
$0.034
Tiempo
91.0s
Tokens
13,523 tok

#139 SpaceXAI: Grok 4.3

medium
Coste
$0.009
Tiempo
19.0s
Tokens
3,661 tok

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Programación Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
Grok 4.20 6.3 6.6 55.6% 1 109.93s 8,307 268 103,150
Grok 4.20 Beta 3.3 3.3 33.3% 0 31.36s 360 81 3,987
Grok 4.3 5.9 7.7 44.4% 1 41.23s 8,340 1,028 31,226

Comparación rápida

Cambiar par de comparación