AI BENCHY Compare

OpenAI: gpt-oss-120b vs Xiaomi: MiMo-V2.5-Pro

Résumé

Comparaison benchmark gpt-oss-120b vs MiMo-V2.5-Pro : gpt-oss-120b mène au score moyen avec 6.1 vs 5.5. gpt-oss-120b a le coût de benchmark le plus bas avec $0.013 vs $0.017. MiMo-V2.5-Pro est plus rapide avec 1.78s vs 22.28s, avec des taux de réussite de 52.4% vs 39.7%.

Modèle recommandé: MiMo-V2.5-Pro - Son score reste proche du meilleur score ici (5.5 vs 6.1) et il répond environ 12.5x plus vite que gpt-oss-120b.

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-06-04

Métrique	gpt-oss-120b gpt-oss-120b medium Sortie: 2025-08-05 Disponible gratuitement	MiMo-V2.5-Pro MiMo-V2.5-Pro none Sortie: 2026-04-22

Métrique	gpt-oss-120b gpt-oss-120b medium Sortie: 2025-08-05 Disponible gratuitement	MiMo-V2.5-Pro MiMo-V2.5-Pro none Sortie: 2026-04-22
Score	6.1	5.5
Rang	#99	#123
Fiabilité	10.0	10.0
Cohérence	8.0	8.6
Tests corrects
Taux de réussite par tentative	52.4%	39.7%
Tests instables	5	4
Exécutions totales	63	63
Coût par résultat	0.141	0.648
Coût total	$0.013	$0.017
Prix d'entrée	$0.039 / 1M	$0.435 / 1M
Prix de sortie	$0.180 / 1M	$0.870 / 1M
Total des jetons d'entrée	39,084	30,724
Jetons de sortie	20,013	3,043
Jetons de raisonnement	50,233	0
Temps de réponse (moy.)	22.28s	1.78s
Temps de réponse (max)	68.16s	8.32s
Temps de réponse (total)	311.96s	37.42s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#99 gpt-oss-120b

medium

Cost: $0.001
Time: 26.7s
Tokens: 555 tok

#123 MiMo-V2.5-Pro

none

Cost: $0.004
Time: 46.4s
Tokens: 4,025 tok

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Astuces anti-IA	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
gpt-oss-120b	6.7	9.9	50.0%	0		10.21s	1,314	3,518	2,177
MiMo-V2.5-Pro	3.3	8.1	8.3%	1		2.67s	645	994	0

Programmation	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
gpt-oss-120b	5.9	7.0	55.6%	1		38.37s	7,782	3,365	11,973
MiMo-V2.5-Pro	4.3	7.8	22.2%	1		1.41s	6,559	485	0

Combiné	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
gpt-oss-120b	10.0	10.0	100.0%	0		31.18s	11,535	694	5,072
MiMo-V2.5-Pro	3.0	10.0	0.0%	0		3.54s	4,695	596	0

Analyse et extraction des données	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
gpt-oss-120b	6.4	5.9	66.7%	1		1.98s	7,476	241	1,114
MiMo-V2.5-Pro	10.0	10.0	100.0%	0		1.32s	7,758	249	0

Spécifique au domaine	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
gpt-oss-120b	2.9	4.4	22.2%	2		50.92s	1,266	6,784	20,606
MiMo-V2.5-Pro	5.3	10.0	33.3%	0		877ms	753	27	0

Intelligence générale	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
gpt-oss-120b	4.3	10.0	0.0%	0		7.90s	659	107	387
MiMo-V2.5-Pro	4.0	10.0	0.0%	0		2.58s	498	87	0

Suivi des instructions	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
gpt-oss-120b	9.9	10.0	100.0%	0		7.63s	1,036	126	1,799
MiMo-V2.5-Pro	6.4	10.0	50.0%	0		1.03s	684	66	0

Résolution d'énigmes	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
gpt-oss-120b	5.3	7.2	44.4%	1		21.71s	1,190	1,790	2,264
MiMo-V2.5-Pro	6.7	4.7	77.8%	2		1.30s	678	267	0

Appel d'outils	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
gpt-oss-120b	9.8	10.0	100.0%	0		6.91s	6,514	287	1,083
MiMo-V2.5-Pro	10.0	10.0	100.0%	0		3.30s	8,238	258	0

Culture générale	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
gpt-oss-120b	3.0	10.0	0.0%	0		26.51s	312	3,101	3,758
MiMo-V2.5-Pro	3.0	10.0	0.0%	0		1.89s	216	14	0

Comparaison rapide

Changer la paire de comparaison

gpt-oss-120bmediumDisponible gratuitementvsGLM 5none Gemini 2.5 Flashnonevsgpt-oss-120bmediumDisponible gratuitement Gemma 4 26B A4BnoneDisponible gratuitementvsgpt-oss-120bmediumDisponible gratuitement DeepSeek V4 Prohighvsgpt-oss-120bmediumDisponible gratuitement Ring-2.6-1Tnonevsgpt-oss-120bmediumDisponible gratuitement CobuddymediumvsMiMo-V2.5-Pronone gpt-oss-120bmediumDisponible gratuitementvsQwen3.5 Plus 2026-02-15none Nemotron 3 Ultra 550b A55bnoneDisponible gratuitementvsgpt-oss-120bmediumDisponible gratuitement MiniMax M2.5mediumvsMiMo-V2.5-Pronone MiniMax M2.7mediumvsMiMo-V2.5-Pronone Mistral Small 4mediumvsMiMo-V2.5-Pronone Nemotron 3 SupermediumDisponible gratuitementvsMiMo-V2.5-Pronone