Urambazaji
AI BENCHY
Advertise here

AI BENCHY Compare

Inception: Mercury 2 vs OpenAI: gpt-oss-120b

Benchmark zimetengenezwa kutoka seti za majaribio za AI BENCHY tarehe: 2026-06-03

Kipimo Mercury 2 Mercury 2 none Toleo: 2026-02-24 gpt-oss-120b gpt-oss-120b medium Toleo: 2025-08-05 Inapatikana bure
Alama 4.6 5.9
Nafasi #153 #103
Uaminifu 10.0 10.0
Uthabiti 9.1 7.9
Majaribio sahihi
Kiwango cha kupita kwa kila jaribio 25.0% 50.0%
Majaribio yasiyo thabiti 2 5
Jumla ya uendeshaji 60 60
Gharama kwa matokeo 0.216 0.151
Jumla ya gharama $0.009 $0.012
Bei ya ingizo $0.250 / 1M $0.039 / 1M
Bei ya toleo $0.750 / 1M $0.180 / 1M
Jumla ya tokeni za ingizo 25,515 36,355
Tokeni za matokeo 3,001 17,495
Tokeni za hoja 0 46,878
Muda wa majibu (wastani) 614ms 22.41s
Muda wa majibu (upeo) 1.27s 68.16s
Muda wa majibu (jumla) 12.28s 291.35s

Modeli bora kwa alama

Alama dhidi ya gharama ya jumla

Muda wa majibu (wastani)

Alama vs Muda wa majibu (wastani)

Jumla ya tokeni za matokeo

Alama vs Jumla ya tokeni za matokeo

Mgawanyo wa kategoria

Mbinu za kupinga AI Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za ingizo Tokeni za matokeo Tokeni za hoja
Mercury 2 3.0 10.0 0.0% 0 483ms 631 286 0
gpt-oss-120b 6.7 9.9 50.0% 0 10.21s 1,314 3,518 2,177
Uandishi wa msimbo Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za ingizo Tokeni za matokeo Tokeni za hoja
Mercury 2 3.5 9.4 0.0% 0 831ms 4,631 1,650 0
gpt-oss-120b 3.9 5.6 33.3% 1 47.24s 5,053 847 8,618
Mchanganyiko Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za ingizo Tokeni za matokeo Tokeni za hoja
Mercury 2 3.0 10.0 0.0% 0 606ms 4,821 131 0
gpt-oss-120b 10.0 10.0 100.0% 0 31.18s 11,535 694 5,072
Uchanganuzi na uchimbaji wa data Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za ingizo Tokeni za matokeo Tokeni za hoja
Mercury 2 7.3 5.9 83.3% 1 667ms 6,362 180 0
gpt-oss-120b 6.4 5.9 66.7% 1 1.98s 7,476 241 1,114
Mahususi kwa domeni Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za ingizo Tokeni za matokeo Tokeni za hoja
Mercury 2 5.3 7.2 44.4% 1 534ms 784 46 0
gpt-oss-120b 2.9 4.4 22.2% 2 50.92s 1,266 6,784 20,606
Akili ya jumla Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za ingizo Tokeni za matokeo Tokeni za hoja
Mercury 2 4.8 10.0 0.0% 0 628ms 495 159 0
gpt-oss-120b 4.3 10.0 0.0% 0 7.90s 659 107 387
Ufuataji wa maagizo Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za ingizo Tokeni za matokeo Tokeni za hoja
Mercury 2 6.5 10.0 50.0% 0 551ms 691 82 0
gpt-oss-120b 9.9 10.0 100.0% 0 7.63s 1,036 126 1,799
Utatuzi wa mafumbo Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za ingizo Tokeni za matokeo Tokeni za hoja
Mercury 2 3.1 10.0 0.0% 0 535ms 694 251 0
gpt-oss-120b 5.3 7.2 44.4% 1 21.71s 1,190 1,790 2,264
Mwito wa zana Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za ingizo Tokeni za matokeo Tokeni za hoja
Mercury 2 10.0 10.0 100.0% 0 1.27s 6,193 197 0
gpt-oss-120b 9.8 10.0 100.0% 0 6.91s 6,514 287 1,083
Maarifa ya jumla Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za ingizo Tokeni za matokeo Tokeni za hoja
Mercury 2 3.0 10.0 0.0% 0 548ms 213 19 0
gpt-oss-120b 3.0 10.0 0.0% 0 26.51s 312 3,101 3,758

Ulinganisho wa haraka

Badilisha jozi ya ulinganisho