Comparer Graphiques Méthodologie

Langue:

❤️ Made by XCS

AI BENCHY Compare

OpenAI: GPT-5.4 vs Z.ai: GLM 5

Comparer:

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-03-06

Métrique	OpenAI: GPT-5.4 medium Sortie: 2026-03-05	Z.ai: GLM 5 none Sortie: 2026-02-12
Rang	#9	#31
Score moy.	8.0	6.0
Cohérence	8.5	10.0
Coût par résultat	6.601	0.200
Coût total	$0.793	$0.018
Tests corrects
Taux de réussite par tentative	83.3%	56.3%
Tests instables	3	0
Exécutions totales	48 (16 x 3)	48 (16 x 3)
Jetons de sortie	1,756	1,548
Jetons de raisonnement	46,642	0
Temps de réponse (moy.)	20.05s	4.03s
Temps de réponse (max)	100.41s	11.07s
Temps de réponse (total)	320.87s	36.30s

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score moy. vs Temps de réponse (moy.)

Répartition par catégorie

Astuces anti-IA	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
OpenAI: GPT-5.4	10.0	10.0	100.0%	0		5.02s	216	1,466
Z.ai: GLM 5	4.0	10.0	33.3%	0		3.39s	272	0

Combiné	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
OpenAI: GPT-5.4	10.0	10.0	100.0%	0		20.57s	301	3,543
Z.ai: GLM 5	10.0	10.0	0.0%	0		4.98s	406	0

Analyse et extraction des données	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
OpenAI: GPT-5.4	9.9	10.0	100.0%	0		5.32s	234	804
Z.ai: GLM 5	9.9	10.0	100.0%	0		5.78s	203	0

Spécifique au domaine	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
OpenAI: GPT-5.4	4.0	7.2	44.4%	1		74.27s	61	34,748
Z.ai: GLM 5	10.0	10.0	0.0%	0		2.24s	19	0

Intelligence générale	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
OpenAI: GPT-5.4	5.0	3.1	33.3%	1		4.92s	145	321
Z.ai: GLM 5	10.0	10.0	100.0%	0		3.27s	103	0

Suivi des instructions	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
OpenAI: GPT-5.4	10.0	10.0	100.0%	0		3.11s	93	897
Z.ai: GLM 5	10.0	10.0	100.0%	0		1.48s	61	0

Puzzle Solving	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
OpenAI: GPT-5.4	7.0	7.2	88.9%	1		9.13s	442	3,832
Z.ai: GLM 5	7.0	10.0	66.7%	0		2.05s	264	0

Appel d'outils	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
OpenAI: GPT-5.4	10.0	10.0	100.0%	0		13.28s	264	1,031
Z.ai: GLM 5	10.0	10.0	100.0%	0		11.07s	220	0

Comparaison rapide

Changer la paire de comparaison

GPT-5 MinimediumvsGLM 5none Gemini 3.1 Flash Lite PreviewhighvsGPT-5.4medium Gemini 3 Flash PreviewlowvsGPT-5.4medium Grok 4.1 FastmediumvsGLM 5none Kimi K2.5mediumvsGLM 5none GPT-5 NanomediumvsGLM 5none GPT-5.2mediumvsGLM 5none Qwen3.5-35B-A3BmediumvsGLM 5none Claude Opus 4.6mediumvsGLM 5none Mercury 2mediumvsGLM 5none Gemini 3.1 Flash Lite PreviewlowvsGPT-5.4medium Gemini 3 Flash PreviewnonevsGPT-5.4medium