DeepSeek: DeepSeek V4 Pro vs Xiaomi: MiMo-V2-Flash
Samenvatting
Benchmarkvergelijking DeepSeek V4 Pro vs MiMo-V2-Flash: DeepSeek V4 Pro leidt in gemiddelde score met 7.2 vs 7.1. DeepSeek V4 Pro heeft lagere benchmarkkosten met $0.034 vs $0.043. DeepSeek V4 Pro is sneller met 6.41s vs 20.11s, met slagingspercentages van 52.4% vs 65.1%.
Aanbevolen model: DeepSeek V4 Pro - Het heeft hier de beste score (7.2) en reageert ongeveer 3.1x sneller dan MiMo-V2-Flash.
Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-06-18
MiMo-V2-FlashMiMo-V2-FlashmediumGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.Releasedatum: 2025-12-16
Score
7.2Gemiddelde score over alle benchmarktests.…
7.1Gemiddelde score over alle benchmarktests.…
Rang
#58
#62
Betrouwbaarheid
9.9Succescore bij de eerste poging: 10.0 betekent geen herhaalbare doel-API- of snelheidslimietfouten vóór succesvolle calls; geregistreerde fouten verlagen de score.…
10.0Succescore bij de eerste poging: 10.0 betekent geen herhaalbare doel-API- of snelheidslimietfouten vóór succesvolle calls; geregistreerde fouten verlagen de score.…
Consistentie
8.8Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
8.8Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
Correcte tests
Een test is alleen volledig geslaagd als alle runs slagen.Verkeerd antwoord: 8Instructies niet gevolgd: 2Extra opmaak: 1Responstijd (gem.)6.41sResponstijd (max)30.09sResponstijd (totaal)134.66sEen test is alleen volledig geslaagd als alle runs slagen.…
6.1Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
16.7%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
2Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Verkeerd antwoord: 2Extra opmaak: 1Instructies niet gevolgd: 1Responstijd (gem.)4.02sResponstijd (max)5.11sResponstijd (totaal)16.10sEen test is alleen volledig geslaagd als alle runs slagen.…
4.02sResponstijd (gem.)…
540Totaal aantal invoer-tokens…
1,168Uitvoer-tokens…
0Redeneer-tokens…
MiMo-V2-FlashGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
8.1Gemiddelde score over alle benchmarktests.…
7.9Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
83.3%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
1Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Extra opmaak: 1Responstijd (gem.)15.85sResponstijd (max)20.83sResponstijd (totaal)47.55sEen test is alleen volledig geslaagd als alle runs slagen.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
33.3%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Instructies niet gevolgd: 1Verkeerd antwoord: 1Responstijd (gem.)13.38sResponstijd (max)30.09sResponstijd (totaal)40.15sEen test is alleen volledig geslaagd als alle runs slagen.…
13.38sResponstijd (gem.)…
7,275Totaal aantal invoer-tokens…
5,500Uitvoer-tokens…
0Redeneer-tokens…
MiMo-V2-FlashGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
6.0Gemiddelde score over alle benchmarktests.…
7.2Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
55.6%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
1Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Time-out: 1Verkeerd antwoord: 1Responstijd (gem.)10.71sResponstijd (max)17.72sResponstijd (totaal)32.13sEen test is alleen volledig geslaagd als alle runs slagen.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)23.74sResponstijd (max)23.74sResponstijd (totaal)23.74sEen test is alleen volledig geslaagd als alle runs slagen.…
23.74sResponstijd (gem.)…
27,529Totaal aantal invoer-tokens…
2,235Uitvoer-tokens…
0Redeneer-tokens…
MiMo-V2-FlashGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
9.8Gemiddelde score over alle benchmarktests.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)75.68sResponstijd (max)75.68sResponstijd (totaal)75.68sEen test is alleen volledig geslaagd als alle runs slagen.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)4.61sResponstijd (max)6.06sResponstijd (totaal)9.23sEen test is alleen volledig geslaagd als alle runs slagen.…
4.61sResponstijd (gem.)…
7,568Totaal aantal invoer-tokens…
200Uitvoer-tokens…
0Redeneer-tokens…
MiMo-V2-FlashGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
6.5Gemiddelde score over alle benchmarktests.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
50.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.API-fout: 1Responstijd (gem.)0msResponstijd (max)0msResponstijd (totaal)0msEen test is alleen volledig geslaagd als alle runs slagen.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
33.3%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Verkeerd antwoord: 2Responstijd (gem.)3.72sResponstijd (max)7.90sResponstijd (totaal)11.17sEen test is alleen volledig geslaagd als alle runs slagen.…
3.72sResponstijd (gem.)…
666Totaal aantal invoer-tokens…
24Uitvoer-tokens…
0Redeneer-tokens…
MiMo-V2-FlashGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
5.9Gemiddelde score over alle benchmarktests.…
7.2Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
55.6%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
1Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Verkeerd antwoord: 2Responstijd (gem.)96.01sResponstijd (max)96.01sResponstijd (totaal)96.01sEen test is alleen volledig geslaagd als alle runs slagen.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
0.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Verkeerd antwoord: 1Responstijd (gem.)2.05sResponstijd (max)2.05sResponstijd (totaal)2.05sEen test is alleen volledig geslaagd als alle runs slagen.…
2.05sResponstijd (gem.)…
471Totaal aantal invoer-tokens…
126Uitvoer-tokens…
0Redeneer-tokens…
MiMo-V2-FlashGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
4.0Gemiddelde score over alle benchmarktests.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
0.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Instructies niet gevolgd: 1Responstijd (gem.)4.20sResponstijd (max)4.20sResponstijd (totaal)4.20sEen test is alleen volledig geslaagd als alle runs slagen.…
5.8Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
66.7%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
1Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Verkeerd antwoord: 1Responstijd (gem.)4.12sResponstijd (max)4.37sResponstijd (totaal)8.24sEen test is alleen volledig geslaagd als alle runs slagen.…
4.12sResponstijd (gem.)…
627Totaal aantal invoer-tokens…
713Uitvoer-tokens…
0Redeneer-tokens…
MiMo-V2-FlashGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
10.0Gemiddelde score over alle benchmarktests.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)4.28sResponstijd (max)7.37sResponstijd (totaal)8.55sEen test is alleen volledig geslaagd als alle runs slagen.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)3.61sResponstijd (max)5.19sResponstijd (totaal)10.83sEen test is alleen volledig geslaagd als alle runs slagen.…
3.61sResponstijd (gem.)…
594Totaal aantal invoer-tokens…
442Uitvoer-tokens…
0Redeneer-tokens…
MiMo-V2-FlashGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
7.7Gemiddelde score over alle benchmarktests.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
66.7%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Verkeerd antwoord: 1Responstijd (gem.)3.87sResponstijd (max)5.26sResponstijd (totaal)7.74sEen test is alleen volledig geslaagd als alle runs slagen.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)7.40sResponstijd (max)7.40sResponstijd (totaal)7.40sEen test is alleen volledig geslaagd als alle runs slagen.…
7.40sResponstijd (gem.)…
8,105Totaal aantal invoer-tokens…
328Uitvoer-tokens…
0Redeneer-tokens…
MiMo-V2-FlashGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
10.0Gemiddelde score over alle benchmarktests.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)27.78sResponstijd (max)27.78sResponstijd (totaal)27.78sEen test is alleen volledig geslaagd als alle runs slagen.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
0.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Verkeerd antwoord: 1Responstijd (gem.)5.76sResponstijd (max)5.76sResponstijd (totaal)5.76sEen test is alleen volledig geslaagd als alle runs slagen.…
5.76sResponstijd (gem.)…
183Totaal aantal invoer-tokens…
688Uitvoer-tokens…
0Redeneer-tokens…
MiMo-V2-FlashGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
3.0Gemiddelde score over alle benchmarktests.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
0.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Verkeerd antwoord: 1Responstijd (gem.)1.96sResponstijd (max)1.96sResponstijd (totaal)1.96sEen test is alleen volledig geslaagd als alle runs slagen.…