AI BENCHY Compare

Poolside: Laguna XS 2.1 vs Z.ai: GLM 5.2

Rezumat

Comparație benchmark Laguna XS 2.1 vs GLM 5.2: GLM 5.2 conduce la scorul mediu cu 7.1 vs 7.0. Laguna XS 2.1 are costul de benchmark mai mic, $0.036 vs $0.051. GLM 5.2 este mai rapid cu 6.34s vs 30.08s, cu rate de reușită de 44.4% vs 60.3%.

Model recomandat: GLM 5.2 - Are cel mai bun scor aici (7.1) și răspunde de aproximativ 4.7x mai rapid decât Laguna XS 2.1.

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-07-02

Metrică	Laguna XS 2.1 Laguna XS 2.1 medium Lansare: 2026-07-02 Disponibil gratuit	GLM 5.2 GLM 5.2 none Lansare: 2026-06-17

Metrică	Laguna XS 2.1 Laguna XS 2.1 medium Lansare: 2026-07-02 Disponibil gratuit	GLM 5.2 GLM 5.2 none Lansare: 2026-06-17
Scor	7.0	7.1
Rang	#67	#63
Fiabilitate	10.0	9.9
Consistență	9.6	9.6
Teste corecte
Rată de trecere pe încercare	44.4%	60.3%
Teste instabile	1	1
Rulări totale	63	63
Cost per rezultat	0.392	0.628
Cost total	$0.036	$0.051
Preț de intrare	$0.060 / 1M	$0.930 / 1M
Preț de ieșire	$0.120 / 1M	$3.000 / 1M
Total tokenuri de intrare	45,324	38,671
Tokenuri de ieșire	25,761	4,817
Tokenuri de raționament	268,677	0
Timp de răspuns (mediu)	30.08s	6.34s
Timp de răspuns (maxim)	155.23s	20.69s
Timp de răspuns (total)	631.77s	133.19s

Prezentare generare

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#67 Laguna XS 2.1

medium

Cost: $0.001
Timp: 30.6s
Tokenuri: 4,678 tok

#63 GLM 5.2

none

SVG invalid

Cost: $0.033
Timp: 87.7s
Tokenuri: 7,455 tok

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Laguna XS 2.1	4.8	10.0	25.0%	0		41.96s	774	353	73,090
GLM 5.2	8.3	10.0	75.0%	0		3.70s	567	313	0

Programare	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Laguna XS 2.1	5.5	10.0	33.3%	0		70.35s	7,995	23,767	83,258
GLM 5.2	3.7	9.5	0.0%	0		7.55s	7,263	1,958	0

Combinat	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Laguna XS 2.1	9.6	10.0	100.0%	0		13.43s	18,033	507	5,908
GLM 5.2	10.0	10.0	100.0%	0		20.69s	14,296	1,489	0

Parsare și extragere de date	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Laguna XS 2.1	10.0	10.0	100.0%	0		4.50s	7,734	234	3,129
GLM 5.2	10.0	10.0	100.0%	0		7.17s	7,113	204	0

Specific domeniului	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Laguna XS 2.1	2.9	7.2	11.1%	1		65.66s	834	17	91,533
GLM 5.2	5.3	10.0	33.3%	0		6.50s	696	27	0

Inteligență generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Laguna XS 2.1	5.0	10.0	0.0%	0		4.15s	537	119	1,375
GLM 5.2	6.1	3.1	66.7%	1		4.42s	480	82	0

Respectarea instrucțiunilor	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Laguna XS 2.1	9.8	10.0	100.0%	0		2.57s	753	82	1,844
GLM 5.2	9.8	10.0	100.0%	0		3.84s	642	66	0

Rezolvare de puzzle-uri	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Laguna XS 2.1	5.3	10.0	33.3%	0		3.43s	771	357	3,355
GLM 5.2	7.7	10.0	66.7%	0		3.31s	618	265	0

Apelare instrumente	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Laguna XS 2.1	10.0	10.0	100.0%	0		3.01s	7,638	309	748
GLM 5.2	10.0	10.0	100.0%	0		15.76s	6,807	400	0

Cultură generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Laguna XS 2.1	3.0	10.0	0.0%	0		10.88s	255	16	4,437
GLM 5.2	3.0	10.0	0.0%	0		3.41s	189	13	0

Comparație rapidă

Schimbă perechea de comparație