Vergelijken Grafieken

Taal:

❤️ Made by XCS

AI BENCHY Compare

Anthropic: Claude Sonnet 4.6 vs Z.ai: GLM 5

Modelnaam:

Benchmarks gegenereerd uit AI BENCHY-testsuites op : 2026-02-27 15:16

Samenvatting

Metriek	Anthropic: Claude Sonnet 4.6 medium Releasedatum: Onbekende releasedatum	Z.ai: GLM 5 none Releasedatum: Onbekende releasedatum
Rang	#8	#19
Score	7.43	6.07
Consistentie	9.40	10.00
Kosten per resultaat	8.105	0.095
Totale kosten	$0.811	$0.008
Correcte tests
Foute tests	4	6
Slaagpercentage per poging	73.8%	57.1%
Instabiele tests	1	0
Uitvoer-tokens	29,098	1,086
Redeneer-tokens	20,435	0

Categorie-uitsplitsing

Anti-AI-trucs	Score	Consistentie	Slaagpercentage per poging	Instabiele tests	Correcte tests	Uitvoer-tokens	Redeneer-tokens
Anthropic: Claude Sonnet 4.6	7.00	10.00	66.7%	0		1,031	1,093
Z.ai: GLM 5	4.00	10.00	33.3%	0		272	0

Gegevensparsering en extractie	Score	Consistentie	Slaagpercentage per poging	Instabiele tests	Correcte tests	Uitvoer-tokens	Redeneer-tokens
Anthropic: Claude Sonnet 4.6	10.00	10.00	100.0%	0		727	907
Z.ai: GLM 5	10.00	10.00	100.0%	0		230	0

Domeinspecifiek	Score	Consistentie	Slaagpercentage per poging	Instabiele tests	Correcte tests	Uitvoer-tokens	Redeneer-tokens
Anthropic: Claude Sonnet 4.6	1.00	7.21	11.1%	1		25,790	16,919
Z.ai: GLM 5	1.00	10.00	0.0%	0		20	0

Instructies opvolgen	Score	Consistentie	Slaagpercentage per poging	Instabiele tests	Correcte tests	Uitvoer-tokens	Redeneer-tokens
Anthropic: Claude Sonnet 4.6	10.00	10.00	100.0%	0		316	523
Z.ai: GLM 5	10.00	10.00	100.0%	0		62	0

Puzzle Solving	Score	Consistentie	Slaagpercentage per poging	Instabiele tests	Correcte tests	Uitvoer-tokens	Redeneer-tokens
Anthropic: Claude Sonnet 4.6	10.00	10.00	100.0%	0		579	642
Z.ai: GLM 5	6.67	9.99	66.7%	0		282	0

Toolaanroepen	Score	Consistentie	Slaagpercentage per poging	Instabiele tests	Correcte tests	Uitvoer-tokens	Redeneer-tokens
Anthropic: Claude Sonnet 4.6	10.00	10.00	100.0%	0		655	351
Z.ai: GLM 5	10.00	10.00	100.0%	0		220	0

Vergelijkingspaar wisselen

Vergelijk Anthropic: Claude Sonnet 4.6 met...

Vergelijk Z.ai: GLM 5 met...