Navegación
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Grok 4.5 (high) vs GLM 5.2 (medium)

La puntuación media está prácticamente empatada en 8.2 vs 8.2. GLM 5.2 (medium) tiene menor coste de benchmark con $0.398 vs $2.571. GLM 5.2 (medium) es más rápido con 26.88s vs 72.50s, con tasas de acierto de 82.6% vs 81.2%.

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-10-01

Modelos comparados

Rango
#82
Total de tokens de salida
333,632
Tiempo de respuesta (promedio)
72.50s
Costo total
$2.571
Rango
#83
Total de tokens de salida
81,020
Tiempo de respuesta (promedio)
26.88s
Costo total
$0.398
Modelo recomendado GLM 5.2 (medium)

Tiene la mejor puntuación aquí (8.2) y cuesta aproximadamente 6.5x menos que Grok 4.5 (high).

Comparación detallada

Métrica Grok 4.5 Grok 4.5 high Lanzamiento: 2026-07-08 GLM 5.2 GLM 5.2 medium Lanzamiento: 2026-06-17
Puntuación 8.2 8.2
Rango #82 #83
Fiabilidad 10.0 9.6
Consistencia 8.9 8.1
Intentos 69/69 66/69
Pruebas correctas
Tasa de aciertos por intento 82.6% 81.2%
Pruebas inestables 3 4
Ejecuciones totales 69 66
Costo por resultado 15.123 2.890
Costo total $2.571 $0.398
Precio de entrada $2.000 / 1M $0.325 / 1M
Precio de salida $6.000 / 1M $3.990 / 1M
Total de tokens de entrada 342,124 227,164
Tokens de salida 7,135 20,029
Tokens de razonamiento 326,497 60,991
Tiempo de respuesta (promedio) 72.50s 26.88s
Tiempo de respuesta (máximo) 676.83s 102.40s
Tiempo de respuesta (total) 1667.51s 591.34s
Parámetros ~1.7T en total (~170B activos) 744B en total (40B activos)
Disponibilidad Código cerrado Código abierto

Generación showcase de modelos

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#82 SpaceXAI: Grok 4.5

high
Coste
$0.015
Tiempo
29.7s
Tokens
2,737 tok

#83 GLM 5.2

medium
Coste
$0.041
Tiempo
195.8s
Tokens
9,287 tok

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Programación Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
Grok 4.5 10.0 10.0 100.0% 0 155.16s 9,579 357 100,752
GLM 5.2 8.2 7.2 88.9% 1 40.96s 7,317 1,475 17,123

Comparación rápida

Cambiar par de comparación