Navegación
AI BENCHY
Advertise here

Qwen: Qwen3.6 Max Preview vs Z.ai: GLM 5.2

La puntuación media está prácticamente empatada en 6.6 vs 6.6. GLM 5.2 tiene menor coste de benchmark con $0.125 vs $0.231. Qwen3.6 Max Preview es más rápido con 7.82s vs 9.34s, con tasas de acierto de 60.6% vs 59.1%.

Modelo recomendadoGLM 5.2Tiene la mejor puntuación aquí (6.6) y cuesta aproximadamente 1.8x menos que Qwen3.6 Max Preview.

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-07-25

Métrica Qwen3.6 Max Preview Qwen3.6 Max Preview none Lanzamiento: 2026-04-20 GLM 5.2 GLM 5.2 none Lanzamiento: 2026-06-17
Puntuación 6.6 6.6
Rango #107 #105
Fiabilidad 9.9 10.0
Consistencia 9.3 9.2
Pruebas correctas
Tasa de aciertos por intento 60.6% 59.1%
Pruebas inestables 2 2
Ejecuciones totales 66 64
Costo por resultado 2.061 1.421
Costo total $0.231 $0.125
Precio de entrada $1.040 / 1M $0.793 / 1M
Precio de salida $6.240 / 1M $2.491 / 1M
Total de tokens de entrada 106,339 112,359
Tokens de salida 19,257 14,340
Tokens de razonamiento 0 0
Tiempo de respuesta (promedio) 7.82s 9.34s
Tiempo de respuesta (máximo) 102.62s 79.65s
Tiempo de respuesta (total) 172.01s 205.46s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#107 Qwen3.6 Max Preview

none
Coste
$0.025
Tiempo
83.9s
Tokens
4,066 tok

#105 GLM 5.2

none
SVG inválido
Coste
$0.033
Tiempo
87.7s
Tokens
7,455 tok

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Programación Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
Qwen3.6 Max Preview 3.8 7.3 22.2% 1 3.12s 7,913 456 0
GLM 5.2 3.7 9.5 0.0% 0 7.55s 7,263 1,958 0

Comparación rápida

Cambiar par de comparación