नेव्हिगेशन
AI BENCHY
Your ad here

AI BENCHY Compare

OpenAI: gpt-oss-120b vs StepFun: Step 3.5 Flash

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-04-11

मेट्रिक gpt-oss-120b gpt-oss-120b medium प्रकाशन: 2025-08-05 मोफत उपलब्ध Step 3.5 Flash Step 3.5 Flash none प्रकाशन: 2026-02-01
स्कोअर 5.8 3.0
क्रमांक #65 #93
सुसंगतता 7.2 10.0
बरोबर चाचण्या
प्रति प्रयत्न पास दर 51.9% 0.0%
अस्थिर चाचण्या 6 0
एकूण रन 54 3
प्रति निकाल खर्च 0.144 0.000
एकूण खर्च $0.011 $0.000
???? ??? $0.039 / 1M $0.100 / 1M
????? ??? $0.190 / 1M $0.300 / 1M
आउटपुट टोकन्स 13,493 0
रिझनिंग टोकन्स 36,879 0
प्रतिसाद वेळ (सरासरी) 16.08s 0ms
प्रतिसाद वेळ (कमाल) 50.92s 0ms
प्रतिसाद वेळ (एकूण) 176.88s 0ms

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
gpt-oss-120b 6.7 9.9 50.0% 0 10.21s 3,518 2,177
Step 3.5 Flash - - - - - - - -
कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
gpt-oss-120b 4.3 1.1 66.7% 1 26.33s 228 2,549
Step 3.5 Flash 3.0 10.0 0.0% 0 0ms 0 0
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
gpt-oss-120b 10.0 10.0 100.0% 0 31.18s 694 5,072
Step 3.5 Flash - - - - - - - -
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
gpt-oss-120b 6.4 5.9 66.7% 1 1.98s 241 1,114
Step 3.5 Flash - - - - - - - -
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
gpt-oss-120b 2.9 4.4 22.2% 2 50.92s 6,784 20,606
Step 3.5 Flash - - - - - - - -
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
gpt-oss-120b 4.3 10.0 0.0% 0 7.90s 107 387
Step 3.5 Flash - - - - - - - -
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
gpt-oss-120b 9.9 10.0 100.0% 0 7.63s 126 1,799
Step 3.5 Flash - - - - - - - -
कोडी सोडवणे स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
gpt-oss-120b 3.2 4.7 22.2% 2 11.80s 1,508 2,092
Step 3.5 Flash - - - - - - - -
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
gpt-oss-120b 9.8 10.0 100.0% 0 6.91s 287 1,083
Step 3.5 Flash - - - - - - - -

झटपट तुलना

तुलना जोडी बदला