AI BENCHY Compare

Qwen: Qwen3.6 Plus vs Z.ai: GLM 5.2

Rezumat

Comparație benchmark Qwen3.6 Plus vs GLM 5.2: Qwen3.6 Plus conduce la scorul mediu cu 7.8 vs 7.1. GLM 5.2 are costul de benchmark mai mic, $0.051 vs $0.294. GLM 5.2 este mai rapid cu 6.34s vs 30.70s, cu rate de reușită de 69.8% vs 60.3%.

Model recomandat: GLM 5.2 - Scorul rămâne aproape de cel mai bun scor de aici (7.1 vs 7.8) și costă de aproximativ 5.8x mai puțin decât Qwen3.6 Plus.

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-07-02

Metrică	Qwen3.6 Plus Qwen3.6 Plus medium Lansare: 2026-04-20	GLM 5.2 GLM 5.2 none Lansare: 2026-06-17

Metrică	Qwen3.6 Plus Qwen3.6 Plus medium Lansare: 2026-04-20	GLM 5.2 GLM 5.2 none Lansare: 2026-06-17
Scor	7.8	7.1
Rang	#31	#63
Fiabilitate	10.0	9.9
Consistență	9.3	9.6
Teste corecte
Rată de trecere pe încercare	69.8%	60.3%
Teste instabile	2	1
Rulări totale	63	63
Cost per rezultat	0.831	0.628
Cost total	$0.294	$0.051
Preț de intrare	$0.325 / 1M	$0.930 / 1M
Preț de ieșire	$1.950 / 1M	$3.000 / 1M
Total tokenuri de intrare	41,565	38,671
Tokenuri de ieșire	1,853	4,817
Tokenuri de raționament	141,973	0
Timp de răspuns (mediu)	30.70s	6.34s
Timp de răspuns (maxim)	201.68s	20.69s
Timp de răspuns (total)	613.99s	133.19s

Prezentare generare

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#31 Qwen3.6 Plus

medium

Cost: $0.024
Timp: 219.0s
Tokenuri: 12,235 tok

#63 GLM 5.2

none

SVG invalid

Cost: $0.033
Timp: 87.7s
Tokenuri: 7,455 tok

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.6 Plus	10.0	10.0	100.0%	0		9.90s	672	207	7,557
GLM 5.2	8.3	10.0	75.0%	0		3.70s	567	313	0

Programare	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.6 Plus	6.1	7.8	44.4%	1		153.12s	7,098	58	50,586
GLM 5.2	3.7	9.5	0.0%	0		7.55s	7,263	1,958	0

Combinat	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.6 Plus	10.0	10.0	100.0%	0		34.95s	14,934	452	13,073
GLM 5.2	10.0	10.0	100.0%	0		20.69s	14,296	1,489	0

Parsare și extragere de date	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.6 Plus	10.0	10.0	100.0%	0		14.95s	7,782	270	10,706
GLM 5.2	10.0	10.0	100.0%	0		7.17s	7,113	204	0

Specific domeniului	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.6 Plus	2.9	7.2	11.1%	1		29.59s	771	56	33,464
GLM 5.2	5.3	10.0	33.3%	0		6.50s	696	27	0

Inteligență generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.6 Plus	5.1	10.0	0.0%	0		27.05s	516	111	5,232
GLM 5.2	6.1	3.1	66.7%	1		4.42s	480	82	0

Respectarea instrucțiunilor	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.6 Plus	10.0	10.0	100.0%	0		7.54s	699	102	5,552
GLM 5.2	9.8	10.0	100.0%	0		3.84s	642	66	0

Rezolvare de puzzle-uri	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.6 Plus	10.0	10.0	100.0%	0		6.34s	696	309	6,712
GLM 5.2	7.7	10.0	66.7%	0		3.31s	618	265	0

Apelare instrumente	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.6 Plus	10.0	10.0	100.0%	0		5.87s	8,193	267	1,330
GLM 5.2	10.0	10.0	100.0%	0		15.76s	6,807	400	0

Cultură generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.6 Plus	3.0	10.0	0.0%	0		47.51s	204	21	7,761
GLM 5.2	3.0	10.0	0.0%	0		3.41s	189	13	0

Comparație rapidă

Schimbă perechea de comparație

Gemma 4 26B A4BmediumDisponibil gratuitvsGLM 5.2none Step 3.7 FlashhighvsGLM 5.2none Laguna XS 2.1mediumDisponibil gratuitvsGLM 5.2none Claude Opus 4.8lowvsQwen3.6 Plusmedium Kimi K2.7 CodemediumvsGLM 5.2none Qwen3.6 PlusmediumvsStep 3.7 Flashlow Grok 4.20mediumvsGLM 5.2none DeepSeek V4 ProhighvsQwen3.6 Plusmedium Gemini 3 Flash PreviewlowvsGLM 5.2none MiMo-V2.5-PromediumvsGLM 5.2none Seed-2.0-MinimediumvsGLM 5.2none Qwen3.5-FlashmediumvsGLM 5.2none