नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

OpenAI: gpt-oss-120b vs Qwen: Qwen3.5-9B

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-03-12

मेट्रिक gpt-oss-120b gpt-oss-120b medium प्रकाशन: 2025-08-05 मोफत उपलब्ध Qwen3.5-9B Qwen3.5-9B none प्रकाशन: 2026-03-02
क्रमांक #43 #60
सरासरी स्कोअर 5.1 3.4
सुसंगतता 7.4 10.0
प्रति निकाल खर्च 0.135 0.111
एकूण खर्च $0.010 $0.005
बरोबर चाचण्या
प्रति प्रयत्न पास दर 54.2% 25.0%
अस्थिर चाचण्या 5 0
एकूण रन 48 48
आउटपुट टोकन्स 13,210 2,939
रिझनिंग टोकन्स 34,230 0
प्रतिसाद वेळ (सरासरी) 16.65s 1.06s
प्रतिसाद वेळ (कमाल) 50.92s 5.91s
प्रतिसाद वेळ (एकूण) 149.88s 16.95s

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

सरासरी स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

सरासरी स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
gpt-oss-120b 7.0 9.8 66.7% 0 19.76s 3,463 2,077
Qwen3.5-9B 10.0 9.9 0.0% 0 1.02s 576 0
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
gpt-oss-120b 10.0 10.0 100.0% 0 31.18s 694 5,072
Qwen3.5-9B 10.0 10.0 0.0% 0 5.91s 1,255 0
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
gpt-oss-120b 5.5 5.9 66.7% 1 1.98s 241 1,114
Qwen3.5-9B 9.9 10.0 100.0% 0 847ms 249 0
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
gpt-oss-120b 10.0 4.4 22.2% 2 50.92s 6,784 20,606
Qwen3.5-9B 10.0 10.0 0.0% 0 464ms 24 0
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
gpt-oss-120b 3.0 10.0 0.0% 0 7.90s 107 387
Qwen3.5-9B 3.0 9.9 0.0% 0 552ms 99 0
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
gpt-oss-120b 9.5 10.0 100.0% 0 7.63s 126 1,799
Qwen3.5-9B 5.5 10.0 50.0% 0 514ms 75 0
Puzzle Solving स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
gpt-oss-120b 1.7 4.7 22.2% 2 11.80s 1,508 2,092
Qwen3.5-9B 10.0 9.9 0.0% 0 683ms 388 0
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
gpt-oss-120b 9.0 10.0 100.0% 0 6.91s 287 1,083
Qwen3.5-9B 10.0 10.0 100.0% 0 1.27s 273 0

झटपट तुलना

तुलना जोडी बदला