AI BENCHY Compare

OpenAI: gpt-oss-120b vs Z.ai: GLM 5.2

Résumé

Comparaison benchmark gpt-oss-120b vs GLM 5.2 : GLM 5.2 mène au score moyen avec 7.1 vs 6.7. gpt-oss-120b a le coût de benchmark le plus bas avec $0.013 vs $0.076. GLM 5.2 est plus rapide avec 6.34s vs 22.28s, avec des taux de réussite de 52.4% vs 60.3%.

Modèle recommandé: gpt-oss-120b - Son score reste proche du meilleur score ici (6.7 vs 7.1) tout en coûtant environ 6.2x moins que GLM 5.2.

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-06-18

Métrique	gpt-oss-120b gpt-oss-120b medium Sortie: 2025-08-05 Disponible gratuitement	GLM 5.2 GLM 5.2 none Sortie: 2026-06-17

Métrique	gpt-oss-120b gpt-oss-120b medium Sortie: 2025-08-05 Disponible gratuitement	GLM 5.2 GLM 5.2 none Sortie: 2026-06-17
Score	6.7	7.1
Rang	#78	#61
Fiabilité	10.0	9.9
Cohérence	8.0	9.6
Tests corrects
Taux de réussite par tentative	52.4%	60.3%
Tests instables	5	1
Exécutions totales	63	63
Coût par résultat	0.141	0.628
Coût total	$0.013	$0.076
Prix d'entrée	$0.039 / 1M	$1.400 / 1M
Prix de sortie	$0.180 / 1M	$4.400 / 1M
Total des jetons d'entrée	39,084	38,671
Jetons de sortie	20,013	4,817
Jetons de raisonnement	50,233	0
Temps de réponse (moy.)	22.28s	6.34s
Temps de réponse (max)	68.16s	20.69s
Temps de réponse (total)	311.96s	133.19s

Génération showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#78 gpt-oss-120b

medium

Coût: $0.001
Temps: 26.7s
Tokens: 555 tok

#61 GLM 5.2

none

SVG invalide

Coût: $0.033
Temps: 87.7s
Tokens: 7,455 tok

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Astuces anti-IA	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
gpt-oss-120b	6.7	9.9	50.0%	0		10.21s	1,314	3,518	2,177
GLM 5.2	8.3	10.0	75.0%	0		3.70s	567	313	0

Programmation	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
gpt-oss-120b	5.9	7.0	55.6%	1		38.37s	7,782	3,365	11,973
GLM 5.2	3.7	9.5	0.0%	0		7.55s	7,263	1,958	0

Combiné	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
gpt-oss-120b	10.0	10.0	100.0%	0		31.18s	11,535	694	5,072
GLM 5.2	10.0	10.0	100.0%	0		20.69s	14,296	1,489	0

Analyse et extraction des données	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
gpt-oss-120b	6.4	5.9	66.7%	1		1.98s	7,476	241	1,114
GLM 5.2	10.0	10.0	100.0%	0		7.17s	7,113	204	0

Spécifique au domaine	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
gpt-oss-120b	2.9	4.4	22.2%	2		50.92s	1,266	6,784	20,606
GLM 5.2	5.3	10.0	33.3%	0		6.50s	696	27	0

Intelligence générale	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
gpt-oss-120b	4.3	10.0	0.0%	0		7.90s	659	107	387
GLM 5.2	6.1	3.1	66.7%	1		4.42s	480	82	0

Suivi des instructions	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
gpt-oss-120b	9.9	10.0	100.0%	0		7.63s	1,036	126	1,799
GLM 5.2	9.8	10.0	100.0%	0		3.84s	642	66	0

Résolution d'énigmes	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
gpt-oss-120b	5.3	7.2	44.4%	1		21.71s	1,190	1,790	2,264
GLM 5.2	7.7	10.0	66.7%	0		3.31s	618	265	0

Appel d'outils	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
gpt-oss-120b	9.8	10.0	100.0%	0		6.91s	6,514	287	1,083
GLM 5.2	10.0	10.0	100.0%	0		15.76s	6,807	400	0

Culture générale	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
gpt-oss-120b	3.0	10.0	0.0%	0		26.51s	312	3,101	3,758
GLM 5.2	3.0	10.0	0.0%	0		3.41s	189	13	0

Comparaison rapide

Changer la paire de comparaison

Gemma 4 26B A4BmediumDisponible gratuitementvsGLM 5.2none Step 3.7 FlashhighvsGLM 5.2none Kimi K2.7 CodemediumvsGLM 5.2none Gemini 3.5 Flashminimalvsgpt-oss-120bmediumDisponible gratuitement gpt-oss-120bmediumDisponible gratuitementvsQwen3.7 Maxnone Gemini 3.1 Flash Lite Previewlowvsgpt-oss-120bmediumDisponible gratuitement Gemini 3 Flash Previewnonevsgpt-oss-120bmediumDisponible gratuitement Grok 4.20mediumvsGLM 5.2none Gemini 3 Flash PreviewlowvsGLM 5.2none Gemini 3.1 Flash Lite Previewnonevsgpt-oss-120bmediumDisponible gratuitement Gemini 3.1 Flash Litelowvsgpt-oss-120bmediumDisponible gratuitement MiMo-V2.5-PromediumvsGLM 5.2none