Urambazaji
AI BENCHY
Your ad here

AI BENCHY Compare

xAI: Grok 4.20 vs Xiaomi: MiMo-V2.5-Pro

Benchmark zimetengenezwa kutoka seti za majaribio za AI BENCHY tarehe: 2026-04-22

Kipimo Grok 4.20 Grok 4.20 medium Toleo: 2026-03-31 MiMo-V2.5-Pro MiMo-V2.5-Pro none Toleo: 2026-04-22
Alama 7.0 5.8
Nafasi #49 #72
Uthabiti 7.8 8.3
Majaribio sahihi
Kiwango cha kupita kwa kila jaribio 66.7% 46.3%
Majaribio yasiyo thabiti 5 4
Jumla ya uendeshaji 54 54
Gharama kwa matokeo 8.252 0.535
Jumla ya gharama $0.743 $0.033
Bei ya ingizo $2.000 / 1M $1.000 / 1M
Bei ya toleo $6.000 / 1M $3.000 / 1M
Tokeni za matokeo 1,744 2,451
Tokeni za hoja 109,882 0
Muda wa majibu (wastani) 10.33s 1.51s
Muda wa majibu (upeo) 29.87s 3.54s
Muda wa majibu (jumla) 185.87s 27.21s

Modeli bora kwa alama

Alama dhidi ya gharama ya jumla

Muda wa majibu (wastani)

Alama vs Muda wa majibu (wastani)

Jumla ya tokeni za matokeo

Alama vs Jumla ya tokeni za matokeo

Mgawanyo wa kategoria

Mbinu za kupinga AI Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za matokeo Tokeni za hoja
Grok 4.20 8.2 7.9 83.3% 1 3.36s 280 8,476
MiMo-V2.5-Pro 2.9 7.9 8.3% 1 1.29s 366 0
Uandishi wa msimbo Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za matokeo Tokeni za hoja
Grok 4.20 4.3 1.1 66.7% 1 24.33s 250 12,804
MiMo-V2.5-Pro 6.4 3.3 66.7% 1 2.39s 452 0
Mchanganyiko Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za matokeo Tokeni za hoja
Grok 4.20 10.0 10.0 100.0% 0 17.40s 232 9,556
MiMo-V2.5-Pro 3.0 10.0 0.0% 0 3.54s 596 0
Uchanganuzi na uchimbaji wa data Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za matokeo Tokeni za hoja
Grok 4.20 10.0 10.0 100.0% 0 4.17s 180 5,333
MiMo-V2.5-Pro 10.0 10.0 100.0% 0 1.32s 249 0
Mahususi kwa domeni Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za matokeo Tokeni za hoja
Grok 4.20 5.3 10.0 33.3% 0 27.03s 375 49,339
MiMo-V2.5-Pro 5.3 10.0 33.3% 0 877ms 27 0
Akili ya jumla Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za matokeo Tokeni za hoja
Grok 4.20 5.8 2.8 66.7% 1 7.09s 47 4,252
MiMo-V2.5-Pro 4.5 10.0 0.0% 0 1.53s 140 0
Ufuataji wa maagizo Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za matokeo Tokeni za hoja
Grok 4.20 7.3 5.9 83.3% 1 4.42s 40 5,474
MiMo-V2.5-Pro 6.4 10.0 50.0% 0 1.03s 66 0
Utatuzi wa mafumbo Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za matokeo Tokeni za hoja
Grok 4.20 6.4 7.7 55.6% 1 3.89s 143 8,028
MiMo-V2.5-Pro 6.7 4.7 77.8% 2 1.32s 297 0
Mwito wa zana Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za matokeo Tokeni za hoja
Grok 4.20 3.0 10.0 0.0% 0 13.68s 197 6,620
MiMo-V2.5-Pro 10.0 10.0 100.0% 0 3.30s 258 0

Ulinganisho wa haraka

Badilisha jozi ya ulinganisho