AI BENCHY Compare

Anthropic: Claude Sonnet 4.6 vs Z.ai: GLM 5

Rezumat

Comparație benchmark Claude Sonnet 4.6 vs GLM 5: GLM 5 conduce la scorul mediu cu 8.6 vs 7.3. GLM 5 are costul de benchmark mai mic, $0.228 vs $0.316. Claude Sonnet 4.6 este mai rapid cu 5.04s vs 33.54s, cu rate de reușită de 55.6% vs 82.5%.

Model recomandat: GLM 5 - Are cel mai puternic scor din această comparație (8.6) și cel mai bun echilibru între cost și timp de răspuns dintre toate cele 2 modele.

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-06-18

Metrică	Claude Sonnet 4.6 Claude Sonnet 4.6 none Lansare: 2026-02-17	GLM 5 GLM 5 medium Lansare: 2026-02-12

Metrică	Claude Sonnet 4.6 Claude Sonnet 4.6 none Lansare: 2026-02-17	GLM 5 GLM 5 medium Lansare: 2026-02-12
Scor	7.3	8.6
Rang	#55	#15
Fiabilitate	10.0	10.0
Consistență	9.7	8.5
Teste corecte
Rată de trecere pe încercare	55.6%	82.5%
Teste instabile	1	4
Rulări totale	63	63
Cost per rezultat	2.870	1.668
Cost total	$0.316	$0.228
Preț de intrare	$3.000 / 1M	$0.600 / 1M
Preț de ieșire	$15.000 / 1M	$1.920 / 1M
Total tokenuri de intrare	57,886	35,224
Tokenuri de ieșire	9,465	21,570
Tokenuri de raționament	0	102,996
Timp de răspuns (mediu)	5.04s	33.54s
Timp de răspuns (maxim)	23.84s	99.85s
Timp de răspuns (total)	70.60s	435.99s

Prezentare generare

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#55 Claude Sonnet 4.6

none

Cost: $0.038
Timp: 27.3s
Tokenuri: 2,598 tok

#15 GLM 5

medium

Cost: $0.005
Timp: 20.7s
Tokenuri: 2,068 tok

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Claude Sonnet 4.6	4.8	10.0	25.0%	0		2.94s	636	1,214	0
GLM 5	10.0	10.0	100.0%	0		23.66s	555	480	7,056

Programare	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Claude Sonnet 4.6	5.5	10.0	33.3%	0		5.19s	8,522	2,127	0
GLM 5	10.0	10.0	100.0%	0		74.30s	7,254	2,997	52,930

Combinat	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Claude Sonnet 4.6	9.5	10.0	100.0%	0		23.84s	26,024	3,766	0
GLM 5	10.0	10.0	100.0%	0		28.96s	12,804	662	3,242

Parsare și extragere de date	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Claude Sonnet 4.6	10.0	10.0	100.0%	0		3.43s	8,574	252	0
GLM 5	7.1	5.6	83.3%	1		8.90s	5,508	567	3,734

Specific domeniului	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Claude Sonnet 4.6	7.7	10.0	66.7%	0		3.54s	759	413	0
GLM 5	3.5	4.4	33.3%	2		0ms	260	13,176	14,137

Inteligență generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Claude Sonnet 4.6	6.1	3.1	66.7%	1		2.56s	513	192	0
GLM 5	6.1	3.1	66.7%	1		14.69s	477	2,020	2,248

Respectarea instrucțiunilor	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Claude Sonnet 4.6	6.5	10.0	50.0%	0		1.96s	690	90	0
GLM 5	10.0	10.0	100.0%	0		7.25s	636	1,001	2,129

Rezolvare de puzzle-uri	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Claude Sonnet 4.6	7.7	10.0	66.7%	0		2.53s	663	533	0
GLM 5	10.0	10.0	100.0%	0		11.33s	609	33	4,076

Apelare instrumente	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Claude Sonnet 4.6	10.0	10.0	100.0%	0		4.11s	11,301	447	0
GLM 5	10.0	10.0	100.0%	0		15.93s	6,935	233	994

Cultură generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Claude Sonnet 4.6	3.0	10.0	0.0%	0		4.67s	204	431	0
GLM 5	3.0	10.0	0.0%	0		67.37s	186	401	12,450

Comparație rapidă

Schimbă perechea de comparație