Urambazaji
AI BENCHY
Advertise here

AI BENCHY Compare

OpenAI: gpt-oss-120b vs xAI: Grok 4.20

Benchmark zimetengenezwa kutoka seti za majaribio za AI BENCHY tarehe: 2026-05-10

Kipimo gpt-oss-120b gpt-oss-120b medium Toleo: 2025-08-05 Inapatikana bure Grok 4.20 Grok 4.20 none Toleo: 2026-03-31
Alama 5.7 5.4
Nafasi #101 #115
Uaminifu 10.0 Haipo
Uthabiti 7.4 9.5
Majaribio sahihi
Kiwango cha kupita kwa kila jaribio 49.1% 35.2%
Majaribio yasiyo thabiti 6 1
Jumla ya uendeshaji 57 54
Gharama kwa matokeo 0.152 1.574
Jumla ya gharama $0.011 $0.095
Bei ya ingizo $0.000 / 1M $1.250 / 1M
Bei ya toleo $0.000 / 1M $2.500 / 1M
Tokeni za matokeo 16,594 1,967
Tokeni za hoja 40,637 0
Muda wa majibu (wastani) 16.95s 1.11s
Muda wa majibu (upeo) 50.92s 6.04s
Muda wa majibu (jumla) 203.39s 20.02s

Modeli bora kwa alama

Alama dhidi ya gharama ya jumla

Muda wa majibu (wastani)

Alama vs Muda wa majibu (wastani)

Jumla ya tokeni za matokeo

Alama vs Jumla ya tokeni za matokeo

Mgawanyo wa kategoria

Mbinu za kupinga AI Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za matokeo Tokeni za hoja
gpt-oss-120b 6.7 9.9 50.0% 0 10.21s 3,518 2,177
Grok 4.20 4.8 10.0 25.0% 0 501ms 267 0
Uandishi wa msimbo Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za matokeo Tokeni za hoja
gpt-oss-120b 4.3 1.1 66.7% 1 26.33s 228 2,549
Grok 4.20 3.4 9.3 0.0% 0 1.22s 312 0
Mchanganyiko Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za matokeo Tokeni za hoja
gpt-oss-120b 10.0 10.0 100.0% 0 31.18s 694 5,072
Grok 4.20 3.0 10.0 0.0% 0 6.04s 282 0
Uchanganuzi na uchimbaji wa data Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za matokeo Tokeni za hoja
gpt-oss-120b 6.4 5.9 66.7% 1 1.98s 241 1,114
Grok 4.20 10.0 10.0 100.0% 0 522ms 207 0
Mahususi kwa domeni Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za matokeo Tokeni za hoja
gpt-oss-120b 2.9 4.4 22.2% 2 50.92s 6,784 20,606
Grok 4.20 3.0 10.0 0.0% 0 687ms 325 0
Akili ya jumla Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za matokeo Tokeni za hoja
gpt-oss-120b 4.3 10.0 0.0% 0 7.90s 107 387
Grok 4.20 4.8 10.0 0.0% 0 659ms 83 0
Ufuataji wa maagizo Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za matokeo Tokeni za hoja
gpt-oss-120b 9.9 10.0 100.0% 0 7.63s 126 1,799
Grok 4.20 6.3 10.0 50.0% 0 455ms 60 0
Utatuzi wa mafumbo Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za matokeo Tokeni za hoja
gpt-oss-120b 3.2 4.7 22.2% 2 11.80s 1,508 2,092
Grok 4.20 5.3 7.2 44.4% 1 487ms 242 0
Mwito wa zana Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za matokeo Tokeni za hoja
gpt-oss-120b 9.8 10.0 100.0% 0 6.91s 287 1,083
Grok 4.20 10.0 10.0 100.0% 0 4.63s 189 0
Maarifa ya jumla Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za matokeo Tokeni za hoja
gpt-oss-120b 3.0 10.0 0.0% 0 26.51s 3,101 3,758
Grok 4.20 - - - - - - - -

Ulinganisho wa haraka

Badilisha jozi ya ulinganisho