Comparer Graphiques

Langue:

❤️ Made by XCS

AI BENCHY Compare

OpenAI: GPT-4o-mini vs OpenAI: GPT-5.4

Comparer:

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-03-05

Métrique	OpenAI: GPT-4o-mini none Sortie: 2024-07-18	OpenAI: GPT-5.4 none Sortie: 2026-03-05
Rang	#46	#44
Score moy.	4.1	4.6
Tests corrects
Cohérence	10.0	8.9
Coût par résultat	0.111	1.496
Coût total	$0.005	$0.090
Taux de réussite par tentative	26.7%	44.4%
Tests instables	0	2
common.totalAttempts	45 (15 x 3)	45 (15 x 3)
Jetons de sortie	1,528	1,635
Jetons de raisonnement	0	0
Temps de réponse (moy.)	2.21s	1.46s
Temps de réponse (max)	7.58s	2.89s
Temps de réponse (total)	17.69s	21.86s

Meilleurs modèles par score

Temps de réponse (moy.)

Score vs coût total

Score moy. vs Temps de réponse (moy.)

Répartition par catégorie

Astuces anti-IA	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
OpenAI: GPT-4o-mini	4.0	10.0	33.3%	0		1.83s	180	0
OpenAI: GPT-5.4	10.0	7.3	11.1%	1		1.41s	388	0

Combiné	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
OpenAI: GPT-4o-mini	10.0	10.0	0.0%	0		7.58s	568	0
OpenAI: GPT-5.4	10.0	10.0	0.0%	0		2.89s	291	0

Analyse et extraction des données	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
OpenAI: GPT-4o-mini	9.9	10.0	100.0%	0		1.27s	183	0
OpenAI: GPT-5.4	9.9	10.0	100.0%	0		1.04s	222	0

Spécifique au domaine	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
OpenAI: GPT-4o-mini	10.0	10.0	0.0%	0		637ms	15	0
OpenAI: GPT-5.4	4.0	7.2	44.4%	1		1.07s	50	0

Suivi des instructions	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
OpenAI: GPT-4o-mini	4.5	10.0	0.0%	0		1.27s	69	0
OpenAI: GPT-5.4	5.5	10.0	50.0%	0		1.07s	81	0

Puzzle Solving	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
OpenAI: GPT-4o-mini	2.3	10.0	0.0%	0		1.30s	308	0
OpenAI: GPT-5.4	4.0	9.8	33.3%	0		1.52s	357	0

Appel d'outils	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
OpenAI: GPT-4o-mini	10.0	10.0	100.0%	0		2.51s	205	0
OpenAI: GPT-5.4	10.0	10.0	100.0%	0		2.75s	246	0

Comparaison rapide

Changer la paire de comparaison

MiniMax M2.5mediumvsGPT-5.4none MiniMax M2.5mediumvsGPT-4o-mininone GPT-4o-mininonevsQwen3 Coder Nextmedium GPT-4o-mininonevsGLM 4.7 Flashmedium Mercury 2mediumvsGPT-5.4none GPT-5.4nonevsQwen3.5-35B-A3Bmedium GPT-5.4nonevsQwen3 Coder Nextmedium GPT-5.4nonevsGLM 4.7 Flashmedium Mercury 2mediumvsGPT-4o-mininone GPT-4o-mininonevsQwen3.5-35B-A3Bmedium Claude Opus 4.6mediumvsGPT-5.4none Kimi K2.5mediumvsGPT-5.4none