AI BENCHY Compare

Qwen: Qwen3.7 Max vs Z.ai: GLM 5.1

Rezumat

Comparație benchmark Qwen3.7 Max vs GLM 5.1: GLM 5.1 conduce la scorul mediu cu 7.1 vs 6.9. Qwen3.7 Max are costul de benchmark mai mic, $0.054 vs $0.395. Qwen3.7 Max este mai rapid cu 1.30s vs 33.67s, cu rate de reușită de 66.7% vs 68.3%.

Model recomandat: Qwen3.7 Max - Scorul rămâne aproape de cel mai bun scor de aici (6.9 vs 7.1) și costă de aproximativ 7.3x mai puțin decât GLM 5.1.

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-07-02

Metrică	Qwen3.7 Max Qwen3.7 Max none Lansare: 2026-05-22	GLM 5.1 GLM 5.1 medium Lansare: 2026-04-07

Metrică	Qwen3.7 Max Qwen3.7 Max none Lansare: 2026-05-22	GLM 5.1 GLM 5.1 medium Lansare: 2026-04-07
Scor	6.9	7.1
Rang	#71	#66
Fiabilitate	10.0	6.7
Consistență	10.0	8.3
Teste corecte
Rată de trecere pe încercare	66.7%	68.3%
Teste instabile	0	4
Rulări totale	63	63
Cost per rezultat	0.744	2.496
Cost total	$0.054	$0.395
Preț de intrare	$1.250 / 1M	$0.975 / 1M
Preț de ieșire	$3.750 / 1M	$4.301 / 1M
Total tokenuri de intrare	37,107	32,995
Tokenuri de ieșire	1,994	11,655
Tokenuri de raționament	0	75,421
Timp de răspuns (mediu)	1.30s	33.67s
Timp de răspuns (maxim)	3.92s	172.60s
Timp de răspuns (total)	27.21s	673.41s

Prezentare generare

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#71 Qwen3.7 Max

none

Cost: $0.046
Timp: 195.0s
Tokenuri: 12,171 tok

#66 GLM 5.1

medium

SVG invalid

Cost: $0.000
Timp: 300.0s
Tokenuri: 0 tok

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.7 Max	6.5	10.0	50.0%	0		1.08s	696	242	0
GLM 5.1	10.0	10.0	100.0%	0		8.31s	555	401	5,122

Programare	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.7 Max	5.5	10.0	33.3%	0		1.35s	7,911	582	0
GLM 5.1	4.6	3.7	44.5%	2		109.63s	5,702	4,871	37,826

Combinat	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.7 Max	3.0	10.0	0.0%	0		2.17s	9,549	171	0
GLM 5.1	9.5	10.0	100.0%	0		43.11s	17,298	327	4,206

Parsare și extragere de date	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.7 Max	10.0	10.0	100.0%	0		1.35s	7,794	243	0
GLM 5.1	10.0	10.0	100.0%	0		9.33s	7,107	991	4,552

Specific domeniului	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.7 Max	7.7	10.0	66.7%	0		975ms	789	15	0
GLM 5.1	5.3	10.0	33.3%	0		29.77s	489	969	11,314

Inteligență generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.7 Max	10.0	10.0	100.0%	0		1.04s	522	120	0
GLM 5.1	10.0	10.0	100.0%	0		20.95s	477	2,875	2,875

Respectarea instrucțiunilor	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.7 Max	10.0	10.0	100.0%	0		943ms	711	72	0
GLM 5.1	6.4	5.8	66.7%	1		7.47s	634	204	1,617

Rezolvare de puzzle-uri	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.7 Max	10.0	10.0	100.0%	0		1.13s	714	314	0
GLM 5.1	8.2	7.2	88.9%	1		31.64s	609	935	5,730

Apelare instrumente	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.7 Max	10.0	10.0	100.0%	0		3.92s	8,211	222	0
GLM 5.1	3.0	10.0	0.0%	0		0ms	0	0	0

Cultură generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.7 Max	3.0	10.0	0.0%	0		856ms	210	13	0
GLM 5.1	3.0	10.0	0.0%	0		29.40s	124	82	2,179

Comparație rapidă

Schimbă perechea de comparație

Step 3.7 FlashhighvsGLM 5.1medium Gemini 3.5 FlashminimalvsQwen3.7 Maxnone Ring-2.6-1TmediumvsQwen3.7 Maxnone Qwen3.7 PlusnonevsGLM 5.1medium DeepSeek V4 PrononevsGLM 5.1medium Gemini 3.5 FlashnonevsGLM 5.1medium Qwen3.7 MaxnonevsMiMo-V2.5medium Claude Opus 4.8nonevsGLM 5.1medium Kimi K2.7 CodemediumvsQwen3.7 Maxnone gpt-oss-120bmediumDisponibil gratuitvsQwen3.7 Maxnone Gemini 3 Flash PreviewnonevsGLM 5.1medium Laguna XS 2.1mediumDisponibil gratuitvsQwen3.7 Maxnone