Navigatie
AI BENCHY
Your ad here

AI BENCHY Compare

Qwen: Qwen3.6 Max Preview vs Xiaomi: MiMo-V2-Omni

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-04-27

Metriek Qwen3.6 Max Preview Qwen3.6 Max Preview none Releasedatum: 2026-04-20 MiMo-V2-Omni MiMo-V2-Omni medium Releasedatum: 2026-03-18
Score 7.3 7.7
Rang #56 #47
Betrouwbaarheid 10.0 n.v.t.
Consistentie 8.7 9.9
Correcte tests
Slaagpercentage per poging 66.7% 61.1%
Instabiele tests 3 0
Totaal runs 54 20
Kosten per resultaat 0.827 1.383
Totale kosten $0.083 $0.153
Invoerprijs $1.300 / 1M $0.400 / 1M
Uitvoerprijs $7.800 / 1M $2.000 / 1M
Uitvoer-tokens 4,732 928
Redeneer-tokens 0 72,661
Responstijd (gem.) 3.38s 16.76s
Responstijd (max) 20.51s 158.78s
Responstijd (totaal) 60.83s 301.61s

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Anti-AI-trucs Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.6 Max Preview 5.2 7.9 41.7% 1 2.63s 513 0
MiMo-V2-Omni 10.0 10.0 100.0% 0 2.11s 112 402
Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.6 Max Preview 5.0 2.0 66.7% 1 3.45s 426 0
MiMo-V2-Omni 4.0 7.9 0.0% 0 68.55s 265 33,660
Gecombineerd Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.6 Max Preview 3.0 10.0 0.0% 0 20.51s 2,842 0
MiMo-V2-Omni 10.0 10.0 100.0% 0 19.29s 131 2,807
Gegevensparsering en extractie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.6 Max Preview 10.0 10.0 100.0% 0 2.87s 243 0
MiMo-V2-Omni 10.0 10.0 100.0% 0 2.29s 87 323
Domeinspecifiek Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.6 Max Preview 7.7 10.0 66.7% 0 1.22s 18 0
MiMo-V2-Omni 3.0 10.0 0.0% 0 55.12s 13 33,279
Algemene intelligentie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.6 Max Preview 4.3 10.0 0.0% 0 1.62s 76 0
MiMo-V2-Omni 10.0 10.0 100.0% 0 2.86s 58 202
Instructies opvolgen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.6 Max Preview 8.4 6.9 83.3% 1 1.45s 69 0
MiMo-V2-Omni 8.3 10.0 50.0% 0 4.92s 35 201
Puzzeloplossing Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.6 Max Preview 10.0 10.0 100.0% 0 2.38s 323 0
MiMo-V2-Omni 6.5 10.0 33.3% 0 3.88s 126 481
Toolaanroepen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.6 Max Preview 10.0 10.0 100.0% 0 5.27s 222 0
MiMo-V2-Omni 10.0 10.0 100.0% 0 11.07s 101 1,306

Snelle vergelijking

Vergelijkingspaar wisselen