नेव्हिगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

gpt-oss-120b vs Qwen3.5-9B (medium)

gpt-oss-120b average score मध्ये पुढे आहे: 4.2 vs 4.0. gpt-oss-120b चा benchmark खर्च कमी आहे: $0.016 vs $0.106. gpt-oss-120b वेगवान आहे: 28.63s vs 110.18s, pass rates 34.8% vs 26.1%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-09

तुलना केलेली मॉडेल्स

क्रमांक
#364
एकूण आउटपुट टोकन्स
62,213
प्रतिसाद वेळ (सरासरी)
28.63s
एकूण खर्च
$0.016
क्रमांक
#368
एकूण आउटपुट टोकन्स
447,247
प्रतिसाद वेळ (सरासरी)
110.18s
एकूण खर्च
$0.106
शिफारस केलेले मॉडेल gpt-oss-120b

It has the best score here (4.2), while costing about 6.8x less than Qwen3.5-9B (medium).

तपशीलवार तुलना

मेट्रिक gpt-oss-120b gpt-oss-120b none प्रकाशन: 2025-08-05 Qwen3.5-9B Qwen3.5-9B medium प्रकाशन: 2026-03-02
स्कोअर 4.2 4.0
क्रमांक #364 #368
विश्वसनीयता 10.0 8.7
सुसंगतता 7.6 7.9
प्रयत्न 60/69 69/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 34.8% 26.1%
अस्थिर चाचण्या 3 6
एकूण रन 60 69
प्रति निकाल खर्च 0.274 3.523
एकूण खर्च $0.016 $0.106
इनपुट किंमत $0.037 / 1M $0.100 / 1M
आउटपुट किंमत $0.170 / 1M $0.150 / 1M
कॅश वाचण्याची किंमत लागू नाही लागू नाही
कॅश लिहिण्याची किंमत लागू नाही लागू नाही
एकूण इनपुट टोकन्स 131,652 387,323
आउटपुट टोकन्स 16,869 48,562
रिझनिंग टोकन्स 53,081 410,431
प्रतिसाद वेळ (सरासरी) 28.63s 110.18s
प्रतिसाद वेळ (कमाल) 140.90s 569.97s
प्रतिसाद वेळ (एकूण) 486.69s 1873.00s
पॅरामीटर्स 117B एकूण (5.1B सक्रिय) 9B
उपलब्धता मुक्त स्रोत मुक्त स्रोत

कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#364 gpt-oss-120b

none
या मॉडेलसाठी अद्याप कोणताही शोकेस निकाल तयार झालेला नाही.
खर्च
लागू नाही
वेळ
-
टोकन्स
0 tok

#368 Qwen3.5-9B

medium
खर्च
$0.001
वेळ
35.9s
टोकन्स
3,030 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
gpt-oss-120b 1.5 0.4 22.2% 1 9.57s 901 204 3,028
Qwen3.5-9B 2.9 10.0 0.0% 0 100.88s 2,396 7,890 41,129

तुलना जोडी बदला

gpt-oss-120bnonevsGLM 4.7 FlashmediumMercury 2.5nonevsQwen3.5-9BmediumMiniMax M2.5mediumvsgpt-oss-120bnoneCobuddymediumमोफत उपलब्धvsgpt-oss-120bnoneLing 3.0 TinydefaultvsQwen3.5-9BmediumGranite 4.1 8bdefaultvsQwen3.5-9BmediumNemotron 3.5 Lightningnoneमोफत उपलब्धvsQwen3.5-9BmediumTrinity Large Previewdefaultमोफत उपलब्धvsgpt-oss-120bnoneKAT Coder AIR V2.5defaultvsgpt-oss-120bnoneMercury 2nonevsQwen3.5-9BmediumRing 2.6 1tdefaultvsgpt-oss-120bnoneLing 3.0 TinyhighvsQwen3.5-9Bmedium