Navigatie
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Qwen: Qwen3.5-122B-A10B vs Xiaomi: MiMo-V2-Pro

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-04-29

Metriek Qwen3.5-122B-A10B Qwen3.5-122B-A10B medium Releasedatum: 2026-02-24 MiMo-V2-Pro MiMo-V2-Pro medium Releasedatum: 2026-03-18
Score 8.1 8.1
Rang #25 #31
Betrouwbaarheid n.v.t. n.v.t.
Consistentie 8.6 8.6
Correcte tests
Slaagpercentage per poging 79.6% 77.8%
Instabiele tests 3 3
Totaal runs 54 48
Kosten per resultaat 4.060 1.320
Totale kosten $0.528 $0.159
Invoerprijs $0.260 / 1M $1.000 / 1M
Uitvoerprijs $2.080 / 1M $3.000 / 1M
Uitvoer-tokens 17,635 2,360
Redeneer-tokens 162,668 38,320
Responstijd (gem.) 31.38s 12.27s
Responstijd (max) 119.29s 64.71s
Responstijd (totaal) 564.84s 208.56s

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Anti-AI-trucs Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5-122B-A10B 10.0 10.0 100.0% 0 9.75s 269 16,835
MiMo-V2-Pro 10.0 10.0 100.0% 0 3.06s 223 1,107
Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5-122B-A10B 4.7 1.6 66.7% 1 70.98s 322 10,694
MiMo-V2-Pro 10.0 10.0 100.0% 0 52.12s 485 11,361
Gecombineerd Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5-122B-A10B 10.0 10.0 100.0% 0 107.79s 483 11,337
MiMo-V2-Pro 4.7 1.6 66.7% 1 64.71s 380 14,186
Gegevensparsering en extractie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5-122B-A10B 10.0 10.0 100.0% 0 23.41s 270 16,558
MiMo-V2-Pro 7.3 5.8 83.3% 1 17.20s 260 7,484
Domeinspecifiek Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5-122B-A10B 2.9 7.2 11.1% 1 63.40s 15,537 64,889
MiMo-V2-Pro 5.3 10.0 33.3% 0 6.00s 155 1,048
Algemene intelligentie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5-122B-A10B 3.4 2.2 33.3% 1 34.11s 66 7,592
MiMo-V2-Pro 10.0 10.0 100.0% 0 4.06s 198 424
Instructies opvolgen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5-122B-A10B 10.0 10.0 100.0% 0 9.88s 77 7,372
MiMo-V2-Pro 9.9 10.0 100.0% 0 3.36s 83 667
Puzzeloplossing Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5-122B-A10B 10.0 10.0 100.0% 0 17.18s 289 26,165
MiMo-V2-Pro 7.0 7.2 55.6% 1 4.71s 313 1,179
Toolaanroepen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5-122B-A10B 10.0 10.0 100.0% 0 4.60s 322 1,226
MiMo-V2-Pro 10.0 10.0 100.0% 0 8.19s 263 864

Snelle vergelijking

Vergelijkingspaar wisselen