Qwen: Qwen3.6 27B vs Xiaomi: MiMo-V2.5

Qwen3.6 27B mène au score moyen avec 5.5 vs 5.1. MiMo-V2.5 a le coût de benchmark le plus bas avec $0.025 vs $0.087. MiMo-V2.5 est plus rapide avec 4.62s vs 10.65s, avec des taux de réussite de 45.5% vs 25.8%.

Modèle recommandéQwen3.6 27BIl obtient le meilleur score de cette comparaison (5.5) et le meilleur équilibre global entre coût et temps de réponse sur les 2 modèles.

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-07-21

Métrique	Qwen3.6 27B Qwen3.6 27B none Sortie: 2026-04-20	MiMo-V2.5 MiMo-V2.5 none Sortie: 2026-04-22

Métrique	Qwen3.6 27B Qwen3.6 27B none Sortie: 2026-04-20	MiMo-V2.5 MiMo-V2.5 none Sortie: 2026-04-22
Score	5.5	5.1
Rang	#158	#174
Fiabilité	10.0	10.0
Cohérence	7.6	9.6
Tests corrects
Taux de réussite par tentative	45.5%	25.8%
Tests instables	6	1
Exécutions totales	66	66
Coût par résultat	1.220	0.770
Coût total	$0.087	$0.025
Prix d'entrée	$0.450 / 1M	$0.140 / 1M
Prix de sortie	$2.700 / 1M	$0.280 / 1M
Total des jetons d'entrée	95,796	141,043
Jetons de sortie	16,155	16,464
Jetons de raisonnement	0	0
Temps de réponse (moy.)	10.65s	4.62s
Temps de réponse (max)	156.31s	55.36s
Temps de réponse (total)	234.39s	101.57s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#158 Qwen3.6 27B

none

Coût: $0.009
Temps: 83.0s
Tokens: 4,549 tok

#174 MiMo-V2.5

none

Coût: $0.007
Temps: 267.4s
Tokens: 25,283 tok

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Catégorie:

Astuces anti-IA	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Qwen3.6 27B	3.8	3.7	41.7%	3		2.83s	696	490	0
MiMo-V2.5	3.5	8.0	16.7%	1		2.19s	645	282	0

Programmation	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Qwen3.6 27B	5.5	10.0	33.3%	0		4.16s	7,913	539	0
MiMo-V2.5	5.5	10.0	33.3%	0		3.24s	7,440	696	0

Combiné	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Qwen3.6 27B	3.2	9.1	0.0%	0		83.13s	65,572	13,744	0
MiMo-V2.5	3.0	10.0	0.0%	0		28.86s	114,133	14,527	0

Analyse et extraction des données	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Qwen3.6 27B	7.3	5.8	83.3%	1		2.06s	7,788	248	0
MiMo-V2.5	6.5	10.0	50.0%	0		1.01s	7,758	366	0

Spécifique au domaine	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Qwen3.6 27B	7.7	10.0	66.7%	0		3.03s	789	24	0
MiMo-V2.5	3.0	10.0	0.0%	0		756ms	753	27	0

Intelligence générale	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Qwen3.6 27B	5.2	9.9	0.0%	0		1.07s	522	72	0
MiMo-V2.5	4.4	9.9	0.0%	0		6.86s	498	81	0

Suivi des instructions	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Qwen3.6 27B	6.2	5.8	66.7%	1		1.92s	711	49	0
MiMo-V2.5	6.5	10.0	50.0%	0		751ms	684	72	0

Résolution d'énigmes	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Qwen3.6 27B	5.3	7.2	44.4%	1		5.15s	714	639	0
MiMo-V2.5	5.4	10.0	33.3%	0		2.13s	678	166	0

Appel d'outils	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Qwen3.6 27B	9.5	10.0	100.0%	0		6.74s	10,881	339	0
MiMo-V2.5	10.0	10.0	100.0%	0		2.43s	8,238	231	0

Culture générale	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Qwen3.6 27B	3.0	10.0	0.0%	0		4.03s	210	11	0
MiMo-V2.5	3.0	10.0	0.0%	0		3.89s	216	16	0

Comparaison rapide

Changer la paire de comparaison

Mistral Small 4mediumvsMiMo-V2.5none KAT-Coder-Air V2.5mediumvsQwen3.6 27Bnone MiniMax M2.7mediumvsMiMo-V2.5none KAT-Coder-Air V2.5highvsQwen3.6 27Bnone KAT-Coder-Air V2.5lowvsQwen3.6 27Bnone Nemotron 3 SupermediumDisponible gratuitementvsQwen3.6 27Bnone KAT-Coder-Air V2.5lowvsMiMo-V2.5none North Mini CodemediumDisponible gratuitementvsQwen3.6 27Bnone Qwen3 Coder NextmediumvsMiMo-V2.5none Mistral Small 4mediumvsQwen3.6 27Bnone CobuddymediumvsMiMo-V2.5none KAT-Coder-Air V2.5mediumvsMiMo-V2.5none