Navigare
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

xAI: Grok 4.20 Beta vs Xiaomi: MiMo-V2-Omni

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-03-21

Metrică Grok 4.20 Beta Grok 4.20 Beta medium Lansare: 2026-03-12 MiMo-V2-Omni MiMo-V2-Omni medium Lansare: 2026-03-18
Scor 7.9 7.9
Rang #23 #22
Consistență 9.0 10.0
Teste corecte
Rată de trecere pe încercare 72.6% 64.7%
Teste instabile 2 0
Rulări totale 51 17
Cost per rezultat 5.525 0.763
Cost total $0.608 $0.084
Preț de intrare $2.000 / 1M $0.400 / 1M
Preț de ieșire $6.000 / 1M $2.000 / 1M
Tokenuri de ieșire 1,487 663
Tokenuri de raționament 87,922 39,001
Timp de răspuns (mediu) 8.54s 13.71s
Timp de răspuns (maxim) 24.21s 158.78s
Timp de răspuns (total) 145.26s 233.06s

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Grok 4.20 Beta 8.7 7.9 91.7% 1 3.16s 268 7,583
MiMo-V2-Omni 10.0 10.0 100.0% 0 2.11s 112 402
Combinat Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Grok 4.20 Beta 10.0 10.0 100.0% 0 20.93s 227 12,212
MiMo-V2-Omni 10.0 10.0 100.0% 0 19.29s 131 2,807
Parsare și extragere de date Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Grok 4.20 Beta 10.0 10.0 100.0% 0 4.01s 180 5,281
MiMo-V2-Omni 10.0 10.0 100.0% 0 2.29s 87 323
Specific domeniului Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Grok 4.20 Beta 5.3 10.0 33.3% 0 21.33s 251 40,255
MiMo-V2-Omni 3.0 10.0 0.0% 0 55.12s 13 33,279
Inteligență generală Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Grok 4.20 Beta 10.0 10.0 100.0% 0 5.78s 72 3,440
MiMo-V2-Omni 10.0 10.0 100.0% 0 2.86s 58 202
Respectarea instrucțiunilor Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Grok 4.20 Beta 8.3 10.0 50.0% 0 4.97s 57 7,107
MiMo-V2-Omni 8.3 10.0 50.0% 0 4.92s 35 201
Puzzle Solving Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Grok 4.20 Beta 8.2 7.2 88.9% 1 3.85s 249 6,660
MiMo-V2-Omni 6.5 10.0 33.3% 0 3.88s 126 481
Apelare instrumente Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Grok 4.20 Beta 3.0 10.0 0.0% 0 12.39s 183 5,384
MiMo-V2-Omni 10.0 10.0 100.0% 0 11.07s 101 1,306

Comparație rapidă

Schimbă perechea de comparație