नेव्हिगेशन
AI BENCHY
Your ad here

AI BENCHY Compare

Qwen: Qwen3.5-9B vs StepFun: Step 3.5 Flash

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-04-11

मेट्रिक Qwen3.5-9B Qwen3.5-9B medium प्रकाशन: 2026-03-02 Step 3.5 Flash Step 3.5 Flash none प्रकाशन: 2026-02-01
स्कोअर 4.4 3.0
क्रमांक #91 #93
सुसंगतता 7.2 10.0
बरोबर चाचण्या
प्रति प्रयत्न पास दर 33.3% 0.0%
अस्थिर चाचण्या 6 0
एकूण रन 54 3
प्रति निकाल खर्च 0.976 0.000
एकूण खर्च $0.030 $0.000
???? ??? $0.050 / 1M $0.100 / 1M
????? ??? $0.150 / 1M $0.300 / 1M
आउटपुट टोकन्स 24,291 0
रिझनिंग टोकन्स 172,597 0
प्रतिसाद वेळ (सरासरी) 73.64s 0ms
प्रतिसाद वेळ (कमाल) 226.38s 0ms
प्रतिसाद वेळ (एकूण) 1104.60s 0ms

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-9B 5.1 5.8 50.0% 2 34.44s 2,621 12,411
Step 3.5 Flash - - - - - - - -
कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-9B 2.6 10.0 0.0% 0 135.61s 6,150 31,393
Step 3.5 Flash 3.0 10.0 0.0% 0 0ms 0 0
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-9B 3.0 10.0 0.0% 0 0ms 0 0
Step 3.5 Flash - - - - - - - -
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-9B 3.6 5.6 33.3% 1 87.31s 1,383 32,113
Step 3.5 Flash - - - - - - - -
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-9B 3.6 7.2 22.2% 1 137.75s 11,549 48,475
Step 3.5 Flash - - - - - - - -
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-9B 2.8 1.6 33.3% 1 226.38s 0 30,695
Step 3.5 Flash - - - - - - - -
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-9B 6.4 5.8 66.7% 1 17.15s 599 4,517
Step 3.5 Flash - - - - - - - -
कोडी सोडवणे स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-9B 3.1 10.0 0.0% 0 33.38s 1,545 11,844
Step 3.5 Flash - - - - - - - -
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-9B 10.0 10.0 100.0% 0 4.31s 444 1,149
Step 3.5 Flash - - - - - - - -

झटपट तुलना

तुलना जोडी बदला