नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Qwen: Qwen3.5-9B vs StepFun: Step 3.5 Flash

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-04-11

मेट्रिक Qwen3.5-9B Qwen3.5-9B none प्रकाशन: 2026-03-02 Step 3.5 Flash Step 3.5 Flash none प्रकाशन: 2026-02-01
स्कोअर 4.8 3.0
क्रमांक #84 #93
सुसंगतता 9.6 10.0
बरोबर चाचण्या
प्रति प्रयत्न पास दर 24.1% 0.0%
अस्थिर चाचण्या 1 0
एकूण रन 54 3
प्रति निकाल खर्च 0.116 0.000
एकूण खर्च $0.005 $0.000
???? ??? $0.050 / 1M $0.100 / 1M
????? ??? $0.150 / 1M $0.300 / 1M
आउटपुट टोकन्स 3,951 0
रिझनिंग टोकन्स 0 0
प्रतिसाद वेळ (सरासरी) 1.47s 0ms
प्रतिसाद वेळ (कमाल) 5.91s 0ms
प्रतिसाद वेळ (एकूण) 26.43s 0ms

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-9B 3.1 9.9 0.0% 0 1.71s 582 0
Step 3.5 Flash - - - - - - - -
कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-9B 5.2 3.4 33.3% 1 5.69s 1,006 0
Step 3.5 Flash 3.0 10.0 0.0% 0 0ms 0 0
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-9B 3.0 10.0 0.0% 0 5.91s 1,255 0
Step 3.5 Flash - - - - - - - -
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-9B 10.0 10.0 100.0% 0 847ms 249 0
Step 3.5 Flash - - - - - - - -
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-9B 3.0 10.0 0.0% 0 464ms 24 0
Step 3.5 Flash - - - - - - - -
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-9B 4.4 9.9 0.0% 0 552ms 99 0
Step 3.5 Flash - - - - - - - -
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-9B 6.5 10.0 50.0% 0 514ms 75 0
Step 3.5 Flash - - - - - - - -
कोडी सोडवणे स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-9B 3.2 9.9 0.0% 0 683ms 388 0
Step 3.5 Flash - - - - - - - -
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-9B 10.0 10.0 100.0% 0 1.27s 273 0
Step 3.5 Flash - - - - - - - -

झटपट तुलना

तुलना जोडी बदला