AI BENCHY Compare

Qwen: Qwen3.5-35B-A3B vs Z.ai: GLM 5 Turbo

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-03-15

Métrica	Qwen3.5-35B-A3B Qwen3.5-35B-A3B medium Lanzamiento: 2026-02-24	GLM 5 Turbo GLM 5 Turbo none Lanzamiento: 2026-03-15

Métrica	Qwen3.5-35B-A3B Qwen3.5-35B-A3B medium Lanzamiento: 2026-02-24	GLM 5 Turbo GLM 5 Turbo none Lanzamiento: 2026-03-15
Rango	#33	#53
Puntuación	7.1	5.7
Consistencia	6.3	9.5
Costo por resultado	4.251	0.467
Costo total	$0.341	$0.028
Pruebas correctas
Tasa de aciertos por intento	77.1%	39.6%
Pruebas inestables	7	1
Ejecuciones totales	48	48
Tokens de salida	5,495	1,264
Tokens de razonamiento	169,266	0
Tiempo de respuesta (promedio)	43.93s	2.92s
Tiempo de respuesta (máximo)	106.00s	8.21s
Tiempo de respuesta (total)	702.85s	46.72s

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Trucos anti-IA	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Qwen3.5-35B-A3B	10.0	10.0	100.0%	0		21.75s	429	36,235
GLM 5 Turbo	3.0	10.0	0.0%	0		3.01s	376	0

Combinado	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Qwen3.5-35B-A3B	4.7	1.6	66.7%	1		75.34s	775	12,485
GLM 5 Turbo	3.0	10.0	0.0%	0		4.89s	144	0

Análisis y extracción de datos	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Qwen3.5-35B-A3B	7.3	5.9	83.3%	1		59.33s	235	19,493
GLM 5 Turbo	10.0	10.0	100.0%	0		2.47s	204	0

Específico del dominio	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Qwen3.5-35B-A3B	4.1	4.4	44.5%	2		88.34s	41	46,368
GLM 5 Turbo	5.3	10.0	33.3%	0		1.97s	25	0

Inteligencia general	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Qwen3.5-35B-A3B	2.8	1.6	33.3%	1		30.30s	20	3,753
GLM 5 Turbo	4.2	9.9	0.0%	0		2.18s	48	0

Seguimiento de instrucciones	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Qwen3.5-35B-A3B	10.0	10.0	100.0%	0		24.45s	97	17,361
GLM 5 Turbo	6.5	10.0	50.0%	0		2.13s	65	0

Puzzle Solving	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Qwen3.5-35B-A3B	6.4	4.4	77.8%	2		31.58s	3,589	32,206
GLM 5 Turbo	5.5	7.4	44.4%	1		2.43s	180	0

Llamada de herramientas	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Qwen3.5-35B-A3B	10.0	10.0	100.0%	0		4.65s	309	1,365
GLM 5 Turbo	10.0	10.0	100.0%	0		8.21s	222	0

Comparación rápida

Cambiar par de comparación

Qwen3.5-35B-A3BmediumvsGLM 5none MiniMax M2.5mediumDisponible gratisvsGLM 5 Turbonone Grok 4.20 Multi-Agent BetamediumvsGLM 5 Turbonone Claude Sonnet 4.6nonevsQwen3.5-35B-A3Bmedium gpt-oss-120bmediumDisponible gratisvsGLM 5 Turbonone DeepSeek V3.2nonevsQwen3.5-35B-A3Bmedium Gemini 3.1 Flash Lite PreviewnonevsQwen3.5-35B-A3Bmedium GPT-5.3 ChatnonevsQwen3.5-35B-A3Bmedium GPT-5 NanomediumvsGLM 5 Turbonone Gemini 3.1 Flash Lite PreviewlowvsQwen3.5-35B-A3Bmedium Mercury 2mediumvsGLM 5 Turbonone Gemini 3 Flash PreviewnonevsQwen3.5-35B-A3Bmedium