AI BENCHY Compare

Qwen: Qwen3.7 Max vs Z.ai: GLM 5

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-05-22

Metrică	Qwen3.7 Max Qwen3.7 Max medium Lansare: 2026-05-22	GLM 5 GLM 5 medium Lansare: 2026-02-12

Metrică	Qwen3.7 Max Qwen3.7 Max medium Lansare: 2026-05-22	GLM 5 GLM 5 medium Lansare: 2026-02-12
Scor	9.0	8.2
Rang	#5	#18
Fiabilitate	10.0	10.0
Consistență	9.6	8.4
Teste corecte
Rată de trecere pe încercare	88.3%	81.7%
Teste instabile	1	4
Rulări totale	60	60
Cost per rezultat	5.540	1.688
Cost total	$0.942	$0.237
Preț de intrare	$2.500 / 1M	$0.600 / 1M
Preț de ieșire	$7.500 / 1M	$1.920 / 1M
Tokenuri de ieșire	2,109	23,219
Tokenuri de raționament	110,285	96,679
Timp de răspuns (mediu)	13.83s	33.39s
Timp de răspuns (maxim)	33.37s	99.85s
Timp de răspuns (total)	276.53s	400.62s

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.7 Max	10.0	10.0	100.0%	0		6.36s	222	8,742
GLM 5	10.0	10.0	100.0%	0		23.66s	480	7,056

Programare	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.7 Max	10.0	10.0	100.0%	0		22.98s	403	22,134
GLM 5	10.0	10.0	100.0%	0		89.47s	2,985	45,706

Combinat	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.7 Max	10.0	10.0	100.0%	0		19.60s	366	8,405
GLM 5	10.0	10.0	100.0%	0		28.96s	662	3,242

Parsare și extragere de date	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.7 Max	10.0	10.0	100.0%	0		8.80s	270	6,254
GLM 5	7.1	5.6	83.3%	1		8.90s	567	3,734

Specific domeniului	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.7 Max	5.9	7.2	55.6%	1		24.94s	61	31,793
GLM 5	3.5	4.4	33.3%	2		0ms	13,176	14,137

Inteligență generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.7 Max	10.0	10.0	100.0%	0		11.70s	135	4,457
GLM 5	6.1	3.1	66.7%	1		14.69s	2,020	2,248

Respectarea instrucțiunilor	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.7 Max	10.0	10.0	100.0%	0		7.46s	102	5,452
GLM 5	10.0	10.0	100.0%	0		7.25s	1,001	2,129

Rezolvare de puzzle-uri	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.7 Max	10.0	10.0	100.0%	0		8.84s	259	8,908
GLM 5	10.0	10.0	100.0%	0		15.64s	1,694	4,983

Apelare instrumente	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.7 Max	10.0	10.0	100.0%	0		6.63s	267	1,220
GLM 5	10.0	10.0	100.0%	0		15.93s	233	994

Cultură generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.7 Max	3.0	10.0	0.0%	0		33.37s	24	12,920
GLM 5	3.0	10.0	0.0%	0		67.37s	401	12,450

Comparație rapidă

Schimbă perechea de comparație

GPT-5.5lowvsQwen3.7 Maxmedium Gemini 3.5 FlashnonevsQwen3.7 Maxmedium Gemini 3.5 FlashminimalvsGLM 5medium Qwen3.7 MaxnonevsGLM 5medium Gemini 3.5 FlashlowvsQwen3.7 Maxmedium Gemini 3 Flash PreviewlowvsQwen3.7 Maxmedium Gemini 3 Flash PreviewlowvsGLM 5medium Gemini 3 Flash PreviewnonevsGLM 5medium Gemini 3.1 Flash Lite PreviewlowvsGLM 5medium GPT-5.2 ChatnonevsGLM 5medium Gemini 3.5 FlashhighvsQwen3.7 Maxmedium Gemini 3.5 FlashnonevsGLM 5medium