नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Qwen: Qwen3.5-Flash vs StepFun: Step 3.7 Flash

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-05-29

मेट्रिक Qwen3.5-Flash Qwen3.5-Flash medium प्रकाशन: 2026-02-24 Step 3.7 Flash Step 3.7 Flash high प्रकाशन: 2026-05-29
स्कोअर 7.6 7.1
क्रमांक #51 #74
विश्वसनीयता 10.0 10.0
सुसंगतता 8.0 8.2
बरोबर चाचण्या
प्रति प्रयत्न पास दर 75.0% 65.8%
अस्थिर चाचण्या 5 4
एकूण रन 60 60
प्रति निकाल खर्च 0.821 8.723
एकूण खर्च $0.099 $0.960
इनपुट किंमत $0.065 / 1M $0.200 / 1M
आउटपुट किंमत $0.260 / 1M $1.150 / 1M
आउटपुट टोकन्स 2,074 828,084
रिझनिंग टोकन्स 272,063 0
प्रतिसाद वेळ (सरासरी) 63.04s 49.43s
प्रतिसाद वेळ (कमाल) 234.29s 192.75s
प्रतिसाद वेळ (एकूण) 1197.71s 988.58s

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-Flash 10.0 10.0 100.0% 0 59.11s 383 32,992
Step 3.7 Flash 10.0 10.0 100.0% 0 13.40s 42,656 0
कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-Flash 4.1 5.8 33.3% 1 54.23s 288 67,546
Step 3.7 Flash 3.6 4.6 25.0% 1 126.82s 164,069 0
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-Flash 10.0 10.0 100.0% 0 17.78s 483 8,270
Step 3.7 Flash 10.0 10.0 100.0% 0 13.01s 8,802 0
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-Flash 7.3 5.9 83.3% 1 56.99s 235 16,237
Step 3.7 Flash 10.0 10.0 100.0% 0 14.72s 23,113 0
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-Flash 5.3 7.2 44.4% 1 146.50s 58 43,615
Step 3.7 Flash 4.1 4.4 44.5% 2 149.64s 410,502 0
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-Flash 6.1 3.1 66.7% 1 40.05s 99 38,486
Step 3.7 Flash 5.5 10.0 0.0% 0 4.17s 2,862 0
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-Flash 10.0 10.0 100.0% 0 63.49s 98 14,139
Step 3.7 Flash 9.8 10.0 100.0% 0 1.52s 2,010 0
कोडी सोडवणे स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-Flash 8.2 7.2 88.9% 1 27.61s 89 12,457
Step 3.7 Flash 5.3 7.2 44.4% 1 10.22s 25,422 0
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-Flash 10.0 10.0 100.0% 0 10.33s 309 1,284
Step 3.7 Flash 10.0 10.0 100.0% 0 2.79s 1,172 0
सामान्य ज्ञान स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-Flash 3.0 10.0 0.0% 0 48.98s 32 37,037
Step 3.7 Flash 3.0 10.0 0.0% 0 149.34s 147,476 0

झटपट तुलना

तुलना जोडी बदला