नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

OpenAI: GPT-5.4 Nano vs Qwen: Qwen3.5-Flash

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-03-17

मेट्रिक GPT-5.4 Nano GPT-5.4 Nano medium प्रकाशन: 2026-03-17 Qwen3.5-Flash Qwen3.5-Flash none प्रकाशन: 2026-02-24
क्रमांक #28 #45
स्कोअर 7.4 6.0
सुसंगतता 9.0 9.6
प्रति निकाल खर्च 0.769 0.077
एकूण खर्च $0.077 $0.006
बरोबर चाचण्या
प्रति प्रयत्न पास दर 66.7% 43.1%
अस्थिर चाचण्या 2 1
एकूण रन 51 51
आउटपुट टोकन्स 2,474 3,777
रिझनिंग टोकन्स 54,516 0
प्रतिसाद वेळ (सरासरी) 11.08s 3.36s
प्रतिसाद वेळ (कमाल) 94.06s 13.73s
प्रतिसाद वेळ (एकूण) 188.39s 57.15s

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.4 Nano 8.3 10.0 75.0% 0 4.52s 683 2,254
Qwen3.5-Flash 3.5 8.3 8.3% 1 1.32s 690 0
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.4 Nano 9.8 10.0 100.0% 0 24.13s 349 5,719
Qwen3.5-Flash 3.0 10.0 0.0% 0 6.22s 1,794 0
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.4 Nano 10.0 10.0 100.0% 0 2.54s 234 516
Qwen3.5-Flash 10.0 10.0 100.0% 0 1.57s 243 0
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.4 Nano 5.9 7.2 55.6% 1 38.18s 60 43,325
Qwen3.5-Flash 7.7 10.0 66.7% 0 905ms 15 0
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.4 Nano 4.5 10.0 0.0% 0 4.15s 179 443
Qwen3.5-Flash 10.0 10.0 100.0% 0 803ms 100 0
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.4 Nano 9.8 10.0 100.0% 0 1.88s 95 521
Qwen3.5-Flash 6.3 10.0 50.0% 0 8.81s 63 0
Puzzle Solving स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.4 Nano 4.0 7.1 22.2% 1 3.65s 640 1,356
Qwen3.5-Flash 3.3 10.0 0.0% 0 5.90s 608 0
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.4 Nano 10.0 10.0 100.0% 0 7.71s 234 382
Qwen3.5-Flash 10.0 10.0 100.0% 0 3.67s 264 0

झटपट तुलना

तुलना जोडी बदला