AI BENCHY Compare

Qwen: Qwen3.5 Plus 2026-04-20 vs Xiaomi: MiMo-V2.5

Résumé

Comparaison benchmark Qwen3.5 Plus 2026-04-20 vs MiMo-V2.5 : Qwen3.5 Plus 2026-04-20 mène au score moyen avec 5.7 vs 4.9. MiMo-V2.5 a le coût de benchmark le plus bas avec $0.007 vs $0.032. MiMo-V2.5 est plus rapide avec 2.20s vs 4.39s, avec des taux de réussite de 41.3% vs 27.0%.

Modèle recommandé: MiMo-V2.5 - Il offre le meilleur compromis global: score compétitif (4.9), coût inférieur à Qwen3.5 Plus 2026-04-20 et temps de réponse équilibré.

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-06-04

Métrique	Qwen3.5 Plus 2026-04-20 Qwen3.5 Plus 2026-04-20 none Sortie: 2026-04-20	MiMo-V2.5 MiMo-V2.5 none Sortie: 2026-04-22

Métrique	Qwen3.5 Plus 2026-04-20 Qwen3.5 Plus 2026-04-20 none Sortie: 2026-04-20	MiMo-V2.5 MiMo-V2.5 none Sortie: 2026-04-22
Score	5.7	4.9
Rang	#114	#143
Fiabilité	10.0	10.0
Cohérence	8.6	9.6
Tests corrects
Taux de réussite par tentative	41.3%	27.0%
Tests instables	4	1
Exécutions totales	63	63
Coût par résultat	0.595	0.413
Coût total	$0.032	$0.007
Prix d'entrée	$0.300 / 1M	$0.140 / 1M
Prix de sortie	$1.800 / 1M	$0.280 / 1M
Total des jetons d'entrée	38,910	41,985
Jetons de sortie	11,145	2,267
Jetons de raisonnement	0	0
Temps de réponse (moy.)	4.39s	2.20s
Temps de réponse (max)	33.34s	6.86s
Temps de réponse (total)	92.26s	46.21s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#114 Qwen3.5 Plus 2026-04-20

none

Cost: $0.008
Time: 77.0s
Tokens: 4,369 tok

#143 MiMo-V2.5

none

Cost: $0.007
Time: 267.4s
Tokens: 25,283 tok

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Astuces anti-IA	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Qwen3.5 Plus 2026-04-20	4.8	10.0	25.0%	0		1.88s	696	557	0
MiMo-V2.5	3.5	8.0	16.7%	1		2.19s	645	282	0

Programmation	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Qwen3.5 Plus 2026-04-20	3.9	7.8	11.1%	1		1.69s	7,913	480	0
MiMo-V2.5	5.5	10.0	33.3%	0		3.24s	7,440	696	0

Combiné	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Qwen3.5 Plus 2026-04-20	2.8	1.6	33.3%	1		13.32s	11,350	2,275	0
MiMo-V2.5	3.0	10.0	0.0%	0		2.36s	15,075	330	0

Analyse et extraction des données	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Qwen3.5 Plus 2026-04-20	10.0	10.0	100.0%	0		2.82s	7,794	243	0
MiMo-V2.5	6.5	10.0	50.0%	0		1.01s	7,758	366	0

Spécifique au domaine	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Qwen3.5 Plus 2026-04-20	5.3	10.0	33.3%	0		4.43s	789	18	0
MiMo-V2.5	3.0	10.0	0.0%	0		756ms	753	27	0

Intelligence générale	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Qwen3.5 Plus 2026-04-20	4.8	10.0	0.0%	0		1.41s	522	119	0
MiMo-V2.5	4.4	9.9	0.0%	0		6.86s	498	81	0

Suivi des instructions	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Qwen3.5 Plus 2026-04-20	6.2	5.8	66.7%	1		1.17s	711	68	0
MiMo-V2.5	6.5	10.0	50.0%	0		751ms	684	72	0

Résolution d'énigmes	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Qwen3.5 Plus 2026-04-20	6.7	7.9	55.6%	1		1.97s	714	583	0
MiMo-V2.5	5.4	10.0	33.3%	0		2.13s	678	166	0

Appel d'outils	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Qwen3.5 Plus 2026-04-20	10.0	10.0	100.0%	0		4.42s	8,211	297	0
MiMo-V2.5	10.0	10.0	100.0%	0		2.43s	8,238	231	0

Culture générale	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Qwen3.5 Plus 2026-04-20	3.0	10.0	0.0%	0		33.34s	210	6,505	0
MiMo-V2.5	3.0	10.0	0.0%	0		3.89s	216	16	0

Comparaison rapide

Changer la paire de comparaison

CobuddymediumvsQwen3.5 Plus 2026-04-20none Nemotron 3 SupermediumDisponible gratuitementvsQwen3.5 Plus 2026-04-20none Qwen3 Coder NextmediumvsMiMo-V2.5none DeepSeek V4 ProhighvsQwen3.5 Plus 2026-04-20none MiniMax M2.5mediumvsQwen3.5 Plus 2026-04-20none MiniMax M2.7mediumvsQwen3.5 Plus 2026-04-20none Mistral Small 4mediumvsQwen3.5 Plus 2026-04-20none Mistral Small 4mediumvsMiMo-V2.5none MiniMax M2.7mediumvsMiMo-V2.5none gpt-oss-120bmediumDisponible gratuitementvsQwen3.5 Plus 2026-04-20none MiniMax M2.5mediumvsMiMo-V2.5none MiMo-V2.5nonevsGLM 4.7 Flashmedium