Navegación
Advertise here

GLM 5.3 FlashX (high) vs GLM 5.3 (low)

GLM 5.3 FlashX (high) lidera en puntuación media con 6.8 vs 6.8. GLM 5.3 FlashX (high) tiene menor coste de benchmark con $0.135 vs $0.167. GLM 5.3 FlashX (high) es más rápido con 12.07s vs 13.65s, con tasas de acierto de 68.2% vs 65.2%.

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-09-21

Modelos comparados

Rango
#163
Total de tokens de salida
83,899
Tiempo de respuesta (promedio)
12.07s
Costo total
$0.135
Rango
#167
Total de tokens de salida
24,808
Tiempo de respuesta (promedio)
13.65s
Costo total
$0.167
Modelo recomendado GLM 5.3 FlashX (high)

Tiene la puntuación más alta en esta comparación (6.8) y el mejor equilibrio general entre coste y tiempo de respuesta en los 2 modelos.

Comparación detallada

Métrica GLM 5.3 FlashX GLM 5.3 FlashX high Lanzamiento: 2026-09-21 GLM 5.3 GLM 5.3 low Lanzamiento: 2026-08-20
Puntuación 6.8 6.8
Rango #163 #167
Fiabilidad 10.0 10.0
Consistencia 8.2 8.5
Intentos 66/66 66/66
Pruebas correctas
Tasa de aciertos por intento 68.2% 65.2%
Pruebas inestables 5 4
Ejecuciones totales 66 66
Costo por resultado 1.125 2.135
Costo total $0.135 $0.167
Precio de entrada $0.370 / 1M $0.910 / 1M
Precio de salida $1.250 / 1M $2.861 / 1M
Total de tokens de entrada 81,365 104,989
Tokens de salida 6,821 8,532
Tokens de razonamiento 77,078 16,276
Tiempo de respuesta (promedio) 12.07s 13.65s
Tiempo de respuesta (máximo) 91.16s 83.60s
Tiempo de respuesta (total) 265.62s 300.22s
Parámetros 320B en total (18B activos) 744B en total (40B activos)
Disponibilidad Código cerrado Código cerrado

Generación showcase de modelos

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#163 GLM 5.3 FlashX

high
Coste
$0.030
Tiempo
169.4s
Tokens
23,950 tok

#167 GLM 5.3

low
Coste
$0.007
Tiempo
28.4s
Tokens
1,599 tok

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Programación Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
GLM 5.3 FlashX 8.2 7.2 88.9% 1 8.06s 7,317 374 9,267
GLM 5.3 6.2 6.9 55.6% 1 21.02s 7,317 368 6,764

Comparación rápida

Cambiar par de comparación