Urambazaji
Advertise here

gpt-oss-120b vs Qwen3.5-9B (medium)

gpt-oss-120b inaongoza kwa average score: 4.2 vs 4.0. gpt-oss-120b ina gharama ya chini ya benchmark: $0.016 vs $0.106. gpt-oss-120b ni ya haraka zaidi: 28.63s vs 110.18s, na pass rates 34.8% vs 26.1%.

Benchmark zimetengenezwa kutoka seti za majaribio za AI BENCHY tarehe: 2026-10-07

Modeli zilizolinganishwa

Nafasi
#361
Jumla ya tokeni za matokeo
62,213
Muda wa majibu (wastani)
28.63s
Jumla ya gharama
$0.016
Nafasi
#365
Jumla ya tokeni za matokeo
447,247
Muda wa majibu (wastani)
110.18s
Jumla ya gharama
$0.106
Muundo unaopendekezwa gpt-oss-120b

It has the best score here (4.2), while costing about 6.8x less than Qwen3.5-9B (medium).

Ulinganisho wa kina

Kipimo gpt-oss-120b gpt-oss-120b none Toleo: 2025-08-05 Qwen3.5-9B Qwen3.5-9B medium Toleo: 2026-03-02
Alama 4.2 4.0
Nafasi #361 #365
Uaminifu 10.0 8.7
Uthabiti 7.6 7.9
Majaribio 60/69 69/69
Majaribio sahihi
Kiwango cha kupita kwa kila jaribio 34.8% 26.1%
Majaribio yasiyo thabiti 3 6
Jumla ya uendeshaji 60 69
Gharama kwa matokeo 0.274 3.523
Jumla ya gharama $0.016 $0.106
Bei ya ingizo $0.037 / 1M $0.100 / 1M
Bei ya toleo $0.170 / 1M $0.150 / 1M
Bei ya kusoma akiba Haipo Haipo
Bei ya kuandika akiba Haipo Haipo
Jumla ya tokeni za ingizo 131,652 387,323
Tokeni za matokeo 16,869 48,562
Tokeni za hoja 53,081 410,431
Muda wa majibu (wastani) 28.63s 110.18s
Muda wa majibu (upeo) 140.90s 569.97s
Muda wa majibu (jumla) 486.69s 1873.00s
Vigezo 117B jumla (5.1B vinavyotumika) 9B
Upatikanaji Chanzo huria Chanzo huria

Bei za akiba zinahusu tokeni za ingizo. Kusoma hutumia tena maelekezo yaliyohifadhiwa; kuandika huyahifadhi na kunaweza kuongeza gharama. Tokeni za matokeo hutumia bei ya matokeo.

Onyesho la kizazi cha modeli

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#361 gpt-oss-120b

none
Hakuna matokeo ya onyesho yaliyozalishwa kwa modeli hii bado.
Gharama
Haipo
Muda
-
Tokeni
0 tok

#365 Qwen3.5-9B

medium
Gharama
$0.001
Muda
35.9s
Tokeni
3,030 tok

Modeli bora kwa alama

Alama dhidi ya gharama ya jumla

Muda wa majibu (wastani)

Alama vs Muda wa majibu (wastani)

Jumla ya tokeni za matokeo

Alama vs Jumla ya tokeni za matokeo

Mgawanyo wa kategoria

Uandishi wa msimbo Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za ingizo Tokeni za matokeo Tokeni za hoja
gpt-oss-120b 1.5 0.4 22.2% 1 9.57s 901 204 3,028
Qwen3.5-9B 2.9 10.0 0.0% 0 100.88s 2,396 7,890 41,129

Badilisha jozi ya ulinganisho