AI BENCHY Compare

Qwen: Qwen3.5 Plus 2026-02-15 vs Xiaomi: MiMo-V2.5

Résumé

Comparaison benchmark Qwen3.5 Plus 2026-02-15 vs MiMo-V2.5 : Qwen3.5 Plus 2026-02-15 mène au score moyen avec 5.8 vs 5.1. MiMo-V2.5 a le coût de benchmark le plus bas avec $0.007 vs $0.016. MiMo-V2.5 est plus rapide avec 2.20s vs 2.31s, avec des taux de réussite de 46.0% vs 27.0%.

Modèle recommandé: MiMo-V2.5 - Son score reste proche du meilleur score ici (5.1 vs 5.8) tout en coûtant environ 2.4x moins que Qwen3.5 Plus 2026-02-15.

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-06-12

Métrique	Qwen3.5 Plus 2026-02-15 Qwen3.5 Plus 2026-02-15 none Sortie: 2026-02-15	MiMo-V2.5 MiMo-V2.5 none Sortie: 2026-04-22

Métrique	Qwen3.5 Plus 2026-02-15 Qwen3.5 Plus 2026-02-15 none Sortie: 2026-02-15	MiMo-V2.5 MiMo-V2.5 none Sortie: 2026-04-22
Score	5.8	5.1
Rang	#111	#139
Fiabilité	10.0	10.0
Cohérence	9.4	9.6
Tests corrects
Taux de réussite par tentative	46.0%	27.0%
Tests instables	2	1
Exécutions totales	63	63
Coût par résultat	0.204	0.413
Coût total	$0.016	$0.007
Prix d'entrée	$0.260 / 1M	$0.140 / 1M
Prix de sortie	$1.560 / 1M	$0.280 / 1M
Total des jetons d'entrée	45,864	41,985
Jetons de sortie	2,480	2,267
Jetons de raisonnement	0	0
Temps de réponse (moy.)	2.31s	2.20s
Temps de réponse (max)	6.65s	6.86s
Temps de réponse (total)	34.63s	46.21s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#111 Qwen3.5 Plus 2026-02-15

none

Cost: $0.012
Time: 153.2s
Tokens: 7,787 tok

#139 MiMo-V2.5

none

Cost: $0.007
Time: 267.4s
Tokens: 25,283 tok

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Astuces anti-IA	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Qwen3.5 Plus 2026-02-15	4.8	10.0	25.0%	0		1.91s	696	517	0
MiMo-V2.5	3.5	8.0	16.7%	1		2.19s	645	282	0

Programmation	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Qwen3.5 Plus 2026-02-15	4.3	7.9	11.1%	1		2.05s	7,913	473	0
MiMo-V2.5	5.5	10.0	33.3%	0		3.24s	7,440	696	0

Combiné	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Qwen3.5 Plus 2026-02-15	3.0	10.0	0.0%	0		6.65s	18,304	314	0
MiMo-V2.5	3.0	10.0	0.0%	0		2.36s	15,075	330	0

Analyse et extraction des données	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Qwen3.5 Plus 2026-02-15	10.0	10.0	100.0%	0		1.89s	7,794	243	0
MiMo-V2.5	6.5	10.0	50.0%	0		1.01s	7,758	366	0

Spécifique au domaine	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Qwen3.5 Plus 2026-02-15	5.3	10.0	33.3%	0		1.17s	789	17	0
MiMo-V2.5	3.0	10.0	0.0%	0		756ms	753	27	0

Intelligence générale	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Qwen3.5 Plus 2026-02-15	4.4	3.0	33.3%	1		2.26s	522	117	0
MiMo-V2.5	4.4	9.9	0.0%	0		6.86s	498	81	0

Suivi des instructions	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Qwen3.5 Plus 2026-02-15	10.0	10.0	100.0%	0		1.67s	711	72	0
MiMo-V2.5	6.5	10.0	50.0%	0		751ms	684	72	0

Résolution d'énigmes	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Qwen3.5 Plus 2026-02-15	7.7	10.0	66.7%	0		2.71s	714	494	0
MiMo-V2.5	5.4	10.0	33.3%	0		2.13s	678	166	0

Appel d'outils	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Qwen3.5 Plus 2026-02-15	10.0	10.0	100.0%	0		3.33s	8,211	222	0
MiMo-V2.5	10.0	10.0	100.0%	0		2.43s	8,238	231	0

Culture générale	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Qwen3.5 Plus 2026-02-15	3.0	10.0	0.0%	0		1.11s	210	11	0
MiMo-V2.5	3.0	10.0	0.0%	0		3.89s	216	16	0

Comparaison rapide

Changer la paire de comparaison

Mistral Small 4mediumvsMiMo-V2.5none MiniMax M2.7mediumvsMiMo-V2.5none CobuddymediumvsMiMo-V2.5none Gemini 3.1 Flash LiteminimalvsQwen3.5 Plus 2026-02-15none MiniMax M2.5mediumvsMiMo-V2.5none Qwen3 Coder NextmediumvsMiMo-V2.5none DeepSeek V4 ProhighvsQwen3.5 Plus 2026-02-15none Gemma 4 31BmediumDisponible gratuitementvsQwen3.5 Plus 2026-02-15none Nemotron 3 SupermediumDisponible gratuitementvsQwen3.5 Plus 2026-02-15none Gemini 3.1 Flash LitelowvsQwen3.5 Plus 2026-02-15none Gemini 3.1 Flash Lite PreviewlowvsQwen3.5 Plus 2026-02-15none MiniMax M2.7mediumvsQwen3.5 Plus 2026-02-15none