AI BENCHY Compare

Mistral: Mistral Small 4 vs OpenAI: GPT-5.4 Nano

Résumé

Comparaison benchmark Mistral Small 4 vs GPT-5.4 Nano : Mistral Small 4 mène au score moyen avec 5.1 vs 4.8. GPT-5.4 Nano a le coût de benchmark le plus bas avec $0.011 vs $0.068. GPT-5.4 Nano est plus rapide avec 1.48s vs 9.40s, avec des taux de réussite de 44.4% vs 30.2%.

Modèle recommandé: GPT-5.4 Nano - Son score reste proche du meilleur score ici (4.8 vs 5.1) tout en coûtant environ 6.5x moins que Mistral Small 4.

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-06-12

Métrique	Mistral Small 4 Mistral Small 4 medium Sortie: 2026-03-16	GPT-5.4 Nano GPT-5.4 Nano none Sortie: 2026-03-17

Métrique	Mistral Small 4 Mistral Small 4 medium Sortie: 2026-03-16	GPT-5.4 Nano GPT-5.4 Nano none Sortie: 2026-03-17
Score	5.1	4.8
Rang	#138	#149
Fiabilité	10.0	10.0
Cohérence	6.9	8.2
Tests corrects
Taux de réussite par tentative	44.4%	30.2%
Tests instables	8	5
Exécutions totales	63	63
Coût par résultat	1.344	0.259
Coût total	$0.068	$0.011
Prix d'entrée	$0.150 / 1M	$0.200 / 1M
Prix de sortie	$0.600 / 1M	$1.250 / 1M
Total des jetons d'entrée	42,576	34,212
Jetons de sortie	24,184	2,784
Jetons de raisonnement	84,678	0
Temps de réponse (moy.)	9.40s	1.48s
Temps de réponse (max)	59.15s	4.47s
Temps de réponse (total)	197.39s	31.01s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#138 Mistral Small 4

medium

Cost: $0.006
Time: 47.9s
Tokens: 9,857 tok

#149 GPT-5.4 Nano

none

Cost: $0.008
Time: 46.1s
Tokens: 5,735 tok

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Astuces anti-IA	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Mistral Small 4	5.6	3.8	66.7%	3		2.67s	708	4,055	4,778
GPT-5.4 Nano	3.5	8.0	16.7%	1		1.18s	606	800	0

Programmation	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Mistral Small 4	4.4	5.1	33.3%	2		39.98s	7,636	11,635	54,715
GPT-5.4 Nano	4.6	7.9	22.2%	1		2.22s	7,305	613	0

Combiné	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Mistral Small 4	3.0	10.0	0.0%	0		25.25s	18,706	2,612	10,700
GPT-5.4 Nano	3.0	10.0	0.0%	0		3.84s	11,019	280	0

Analyse et extraction des données	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Mistral Small 4	7.3	5.9	83.3%	1		1.23s	6,171	335	723
GPT-5.4 Nano	6.5	10.0	50.0%	0		1.11s	7,140	219	0

Spécifique au domaine	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Mistral Small 4	5.3	7.2	44.4%	1		6.11s	742	2,621	6,904
GPT-5.4 Nano	2.9	4.4	22.2%	2		926ms	723	52	0

Intelligence générale	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Mistral Small 4	4.8	10.0	0.0%	0		2.05s	519	821	828
GPT-5.4 Nano	3.8	2.5	33.3%	1		1.31s	477	180	0

Suivi des instructions	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Mistral Small 4	7.3	5.8	83.3%	1		1.38s	729	540	1,031
GPT-5.4 Nano	6.3	10.0	50.0%	0		784ms	660	89	0

Résolution d'énigmes	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Mistral Small 4	3.4	9.7	0.0%	0		2.17s	735	1,226	2,632
GPT-5.4 Nano	5.4	10.0	33.3%	0		1.25s	642	308	0

Appel d'outils	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Mistral Small 4	10.0	10.0	100.0%	0		3.50s	6,420	321	810
GPT-5.4 Nano	10.0	10.0	100.0%	0		3.40s	5,445	222	0

Culture générale	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Mistral Small 4	3.0	10.0	0.0%	0		5.92s	210	18	1,557
GPT-5.4 Nano	3.0	10.0	0.0%	0		773ms	195	21	0

Comparaison rapide

Changer la paire de comparaison

Mistral Small 4mediumvsMiMo-V2.5none Mistral Small 4mediumvsQwen3.5-9Bnone Mistral Small 4mediumvsQwen3 Coder Nextnone Mistral Small 4mediumvsQwen3.6 35B A3Bnone MiniMax M2.5mediumvsGPT-5.4 Nanonone Trinity Large PreviewnonevsMistral Small 4medium GPT-5.4 NanononevsQwen3 Coder Nextmedium CobuddymediumvsGPT-5.4 Nanonone Mistral Small 4mediumvsGPT-4o-mininone DeepSeek V3.2nonevsMistral Small 4medium Mistral Small 4mediumvsQwen3.5-122B-A10Bnone Mistral Small 4mediumvsGPT-5.4 Mininone