Navigatie
AI BENCHY
Your ad here

AI BENCHY Compare

OpenAI: GPT-5.3 Chat vs Xiaomi: MiMo-V2-Omni

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-05-01

Metriek GPT-5.3 Chat GPT-5.3 Chat none Releasedatum: 2026-03-03 MiMo-V2-Omni MiMo-V2-Omni medium Releasedatum: 2026-03-18
Score 7.9 7.7
Rang #42 #49
Betrouwbaarheid n.v.t. n.v.t.
Consistentie 8.6 9.9
Correcte tests
Slaagpercentage per poging 74.1% 61.1%
Instabiele tests 3 0
Totaal runs 54 20
Kosten per resultaat 2.826 1.383
Totale kosten $0.340 $0.153
Invoerprijs $1.750 / 1M $0.400 / 1M
Uitvoerprijs $14.000 / 1M $2.000 / 1M
Uitvoer-tokens 20,784 928
Redeneer-tokens 0 72,661
Responstijd (gem.) 5.88s 16.76s
Responstijd (max) 18.33s 158.78s
Responstijd (totaal) 105.90s 301.61s

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Anti-AI-trucs Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.3 Chat 6.7 8.1 58.3% 1 3.86s 3,167 0
MiMo-V2-Omni 10.0 10.0 100.0% 0 2.11s 112 402
Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.3 Chat 10.0 10.0 100.0% 0 9.32s 1,436 0
MiMo-V2-Omni 4.0 7.9 0.0% 0 68.55s 265 33,660
Gecombineerd Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.3 Chat 10.0 10.0 100.0% 0 11.96s 2,614 0
MiMo-V2-Omni 10.0 10.0 100.0% 0 19.29s 131 2,807
Gegevensparsering en extractie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.3 Chat 10.0 10.0 100.0% 0 2.21s 942 0
MiMo-V2-Omni 10.0 10.0 100.0% 0 2.29s 87 323
Domeinspecifiek Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.3 Chat 3.5 4.4 33.3% 2 13.01s 8,264 0
MiMo-V2-Omni 3.0 10.0 0.0% 0 55.12s 13 33,279
Algemene intelligentie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.3 Chat 4.6 10.0 0.0% 0 1.99s 319 0
MiMo-V2-Omni 10.0 10.0 100.0% 0 2.86s 58 202
Instructies opvolgen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.3 Chat 9.8 10.0 100.0% 0 3.29s 1,455 0
MiMo-V2-Omni 8.3 10.0 50.0% 0 4.92s 35 201
Puzzeloplossing Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.3 Chat 10.0 10.0 100.0% 0 2.93s 1,726 0
MiMo-V2-Omni 6.5 10.0 33.3% 0 3.88s 126 481
Toolaanroepen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.3 Chat 10.0 10.0 100.0% 0 8.36s 861 0
MiMo-V2-Omni 10.0 10.0 100.0% 0 11.07s 101 1,306

Snelle vergelijking

Vergelijkingspaar wisselen