Navigation
AI BENCHY
Your ad here

AI BENCHY Compare

DeepSeek: DeepSeek V4 Flash vs Xiaomi: MiMo-V2.5-Pro

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-04-27

Métrique DeepSeek V4 Flash DeepSeek V4 Flash high Sortie: 2026-04-24 MiMo-V2.5-Pro MiMo-V2.5-Pro medium Sortie: 2026-04-22
Score 7.8 8.1
Rang #41 #30
Fiabilité 10.0 N/D
Cohérence 7.8 8.8
Tests corrects
Taux de réussite par tentative 79.6% 75.9%
Tests instables 5 3
Exécutions totales 54 54
Coût par résultat 0.277 1.674
Coût total $0.031 $0.201
Prix d'entrée $0.140 / 1M $1.000 / 1M
Prix de sortie $0.280 / 1M $3.000 / 1M
Jetons de sortie 1,765 2,735
Jetons de raisonnement 90,299 52,571
Temps de réponse (moy.) 45.41s 16.17s
Temps de réponse (max) 218.13s 84.22s
Temps de réponse (total) 817.30s 291.09s

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Astuces anti-IA Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
DeepSeek V4 Flash 8.3 10.0 75.0% 0 28.51s 140 7,770
MiMo-V2.5-Pro 10.0 10.0 100.0% 0 2.95s 273 1,363
Programmation Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
DeepSeek V4 Flash 10.0 10.0 100.0% 0 62.48s 369 9,361
MiMo-V2.5-Pro 10.0 10.0 100.0% 0 32.58s 543 7,485
Combiné Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
DeepSeek V4 Flash 10.0 10.0 100.0% 0 76.57s 465 7,347
MiMo-V2.5-Pro 10.0 10.0 100.0% 0 53.36s 348 11,870
Analyse et extraction des données Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
DeepSeek V4 Flash 10.0 10.0 100.0% 0 28.03s 201 1,179
MiMo-V2.5-Pro 7.3 5.8 83.3% 1 18.81s 260 8,383
Spécifique au domaine Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
DeepSeek V4 Flash 4.1 4.4 44.5% 2 100.31s 27 59,249
MiMo-V2.5-Pro 5.3 10.0 33.3% 0 37.87s 275 17,023
Intelligence générale Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
DeepSeek V4 Flash 6.1 3.1 66.7% 1 25.15s 79 632
MiMo-V2.5-Pro 5.1 3.3 33.3% 1 4.27s 150 549
Suivi des instructions Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
DeepSeek V4 Flash 10.0 10.0 100.0% 0 15.36s 63 1,622
MiMo-V2.5-Pro 9.9 10.0 100.0% 0 2.77s 82 803
Résolution d'énigmes Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
DeepSeek V4 Flash 6.4 4.5 77.8% 2 25.53s 193 2,597
MiMo-V2.5-Pro 6.7 7.9 55.6% 1 5.16s 493 2,187
Appel d'outils Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
DeepSeek V4 Flash 10.0 10.0 100.0% 0 74.73s 228 542
MiMo-V2.5-Pro 10.0 10.0 100.0% 0 16.87s 311 2,908

Comparaison rapide

Changer la paire de comparaison