नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

OpenAI: gpt-oss-120b vs Qwen: Qwen3.5 Plus 2026-04-20

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-04-27

मेट्रिक gpt-oss-120b gpt-oss-120b medium प्रकाशन: 2025-08-05 मोफत उपलब्ध Qwen3.5 Plus 2026-04-20 Qwen3.5 Plus 2026-04-20 none प्रकाशन: 2026-04-20
स्कोअर 5.8 5.8
क्रमांक #86 #88
विश्वसनीयता लागू नाही 9.8
सुसंगतता 7.2 8.3
बरोबर चाचण्या
प्रति प्रयत्न पास दर 51.9% 42.6%
अस्थिर चाचण्या 6 4
एकूण रन 54 54
प्रति निकाल खर्च 0.144 0.397
एकूण खर्च $0.011 $0.024
???? ??? $0.000 / 1M $0.400 / 1M
????? ??? $0.000 / 1M $2.400 / 1M
आउटपुट टोकन्स 13,493 4,645
रिझनिंग टोकन्स 36,879 0
प्रतिसाद वेळ (सरासरी) 16.08s 3.18s
प्रतिसाद वेळ (कमाल) 50.92s 13.32s
प्रतिसाद वेळ (एकूण) 176.88s 57.24s

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
gpt-oss-120b 6.7 9.9 50.0% 0 10.21s 3,518 2,177
Qwen3.5 Plus 2026-04-20 4.8 10.0 25.0% 0 1.88s 557 0
कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
gpt-oss-120b 4.3 1.1 66.7% 1 26.33s 228 2,549
Qwen3.5 Plus 2026-04-20 5.3 3.4 33.3% 1 3.20s 450 0
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
gpt-oss-120b 10.0 10.0 100.0% 0 31.18s 694 5,072
Qwen3.5 Plus 2026-04-20 2.8 1.6 33.3% 1 13.32s 2,275 0
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
gpt-oss-120b 6.4 5.9 66.7% 1 1.98s 241 1,114
Qwen3.5 Plus 2026-04-20 10.0 10.0 100.0% 0 2.82s 243 0
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
gpt-oss-120b 2.9 4.4 22.2% 2 50.92s 6,784 20,606
Qwen3.5 Plus 2026-04-20 5.3 10.0 33.3% 0 4.43s 18 0
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
gpt-oss-120b 4.3 10.0 0.0% 0 7.90s 107 387
Qwen3.5 Plus 2026-04-20 4.8 10.0 0.0% 0 1.41s 119 0
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
gpt-oss-120b 9.9 10.0 100.0% 0 7.63s 126 1,799
Qwen3.5 Plus 2026-04-20 6.2 5.8 66.7% 1 1.17s 68 0
कोडी सोडवणे स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
gpt-oss-120b 3.2 4.7 22.2% 2 11.80s 1,508 2,092
Qwen3.5 Plus 2026-04-20 4.8 7.9 22.2% 1 2.03s 618 0
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
gpt-oss-120b 9.8 10.0 100.0% 0 6.91s 287 1,083
Qwen3.5 Plus 2026-04-20 10.0 10.0 100.0% 0 4.42s 297 0

झटपट तुलना

तुलना जोडी बदला