AI BENCHY Compare

Modèles comparés

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-04-04

Métrique	Hunter Alpha Hunter Alpha medium Sortie: 2026-03-11	MiMo-V2-Pro MiMo-V2-Pro medium Sortie: 2026-03-18	MiMo-V2-Omni MiMo-V2-Omni medium Sortie: 2026-03-18

Métrique	Hunter Alpha Hunter Alpha medium Sortie: 2026-03-11	MiMo-V2-Pro MiMo-V2-Pro medium Sortie: 2026-03-18	MiMo-V2-Omni MiMo-V2-Omni medium Sortie: 2026-03-18
Score	7.0	8.0	7.9
Rang	#43	#24	#26
Cohérence	7.2	8.5	10.0
Tests corrects
Taux de réussite par tentative	68.6%	76.5%	64.7%
Tests instables	6	3	0
Exécutions totales	51	45	17
Coût par résultat	0.000	1.110	0.763
Coût total	$0.000	$0.123	$0.084
Prix d'entrée	$0.000 / 1M	$1.000 / 1M	$0.400 / 1M
Prix de sortie	$0.000 / 1M	$3.000 / 1M	$2.000 / 1M
Jetons de sortie	4,724	1,875	663
Jetons de raisonnement	17,921	26,959	39,001
Temps de réponse (moy.)	10.33s	9.78s	13.71s
Temps de réponse (max)	30.53s	64.71s	158.78s
Temps de réponse (total)	175.60s	156.45s	233.06s

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Astuces anti-IA	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Hunter Alpha	7.3	5.8	83.3%	2		4.75s	479	1,103
MiMo-V2-Pro	10.0	10.0	100.0%	0		3.06s	223	1,107
MiMo-V2-Omni	10.0	10.0	100.0%	0		2.11s	112	402

Combiné	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Hunter Alpha	4.7	1.6	66.7%	1		30.53s	792	3,456
MiMo-V2-Pro	4.7	1.6	66.7%	1		64.71s	380	14,186
MiMo-V2-Omni	10.0	10.0	100.0%	0		19.29s	131	2,807

Analyse et extraction des données	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Hunter Alpha	10.0	10.0	100.0%	0		23.16s	1,488	8,017
MiMo-V2-Pro	7.3	5.8	83.3%	1		17.20s	260	7,484
MiMo-V2-Omni	10.0	10.0	100.0%	0		2.29s	87	323

Spécifique au domaine	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Hunter Alpha	3.0	10.0	0.0%	0		10.52s	892	2,406
MiMo-V2-Pro	5.3	10.0	33.3%	0		6.00s	155	1,048
MiMo-V2-Omni	3.0	10.0	0.0%	0		55.12s	13	33,279

Intelligence générale	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Hunter Alpha	7.0	3.7	66.7%	1		6.44s	116	260
MiMo-V2-Pro	10.0	10.0	100.0%	0		4.06s	198	424
MiMo-V2-Omni	10.0	10.0	100.0%	0		2.86s	58	202

Suivi des instructions	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Hunter Alpha	9.9	10.0	100.0%	0		4.18s	208	465
MiMo-V2-Pro	9.9	10.0	100.0%	0		3.36s	83	667
MiMo-V2-Omni	8.3	10.0	50.0%	0		4.92s	35	201

Puzzle Solving	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Hunter Alpha	6.1	4.7	66.7%	2		5.36s	441	1,310
MiMo-V2-Pro	7.0	7.2	55.6%	1		4.71s	313	1,179
MiMo-V2-Omni	6.5	10.0	33.3%	0		3.88s	126	481

Appel d'outils	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Hunter Alpha	10.0	10.0	100.0%	0		17.33s	308	904
MiMo-V2-Pro	10.0	10.0	100.0%	0		8.19s	263	864
MiMo-V2-Omni	10.0	10.0	100.0%	0		11.07s	101	1,306

Comparaison rapide

Changer la paire de comparaison

Gemini 3 Flash PreviewnonevsMiMo-V2-Promedium Gemini 3.1 Flash Lite PreviewlowvsMiMo-V2-Promedium Gemini 3 Flash PreviewnonevsMiMo-V2-Omnimedium Gemini 3.1 Flash Lite PreviewlowvsMiMo-V2-Omnimedium Gemini 3.1 Flash Lite PreviewnonevsMiMo-V2-Omnimedium GPT-5.2 ChatnonevsMiMo-V2-Omnimedium Gemini 3.1 Flash Lite PreviewnonevsMiMo-V2-Promedium GPT-5.2 ChatnonevsMiMo-V2-Promedium Hunter AlphamediumvsQwen3.5 Plus 2026-02-15none Gemma 4 31BnonevsHunter Alphamedium Hunter AlphamediumvsGLM 5none Claude Sonnet 4.6nonevsHunter Alphamedium