नेविगेशन
AI BENCHY
Advertise here

gpt-oss-120b (medium) vs Inkling (low)

average score लगभग बराबर है: 6.1 vs 6.1. gpt-oss-120b (medium) की benchmark लागत कम है: $0.020 vs $0.187. Inkling (low) तेज है: 5.11s vs 20.81s, pass rates 50.0% vs 54.6%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-03

रैंक
#184
कुल आउटपुट टोकन
98,282
प्रतिक्रिया समय (औसत)
20.81s
कुल लागत
$0.020
रैंक
#188
कुल आउटपुट टोकन
18,904
प्रतिक्रिया समय (औसत)
5.11s
कुल लागत
$0.187
अनुशंसित मॉडल gpt-oss-120b (medium)

It has the best score here (6.1), while costing about 9.8x less than Inkling (low).

विस्तृत तुलना

मेट्रिक gpt-oss-120b gpt-oss-120b medium रिलीज़: 2025-08-05 Inkling Inkling low रिलीज़: 2026-07-18
स्कोर 6.1 6.1
रैंक #184 #188
विश्वसनीयता 10.0 10.0
संगति 8.0 8.6
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 50.0% 54.6%
अस्थिर टेस्ट 5 4
कुल रन 66 66
प्रति परिणाम लागत 0.224 1.865
कुल लागत $0.020 $0.187
इनपुट कीमत $0.037 / 1M $1.000 / 1M
आउटपुट कीमत $0.170 / 1M $4.050 / 1M
कुल इनपुट टोकन 108,767 109,893
आउटपुट टोकन 29,378 8,580
रीजनिंग टोकन 68,904 10,324
प्रतिक्रिया समय (औसत) 20.81s 5.11s
प्रतिक्रिया समय (अधिकतम) 68.16s 41.58s
प्रतिक्रिया समय (कुल) 332.88s 112.46s
पैरामीटर 117B कुल (5.1B सक्रिय) 975B कुल (41B सक्रिय)
उपलब्धता मुक्त स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#184 gpt-oss-120b

medium
लागत
$0.001
समय
26.7s
टोकन
555 tok

#188 Thinking Machines: Inkling

low
लागत
$0.002
समय
6.1s
टोकन
502 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
gpt-oss-120b 5.9 7.0 55.6% 1 38.37s 7,782 3,365 11,973
Inkling 5.1 7.2 22.2% 1 8.71s 7,374 355 4,961

त्वरित तुलना

तुलना जोड़ी बदलें