नेव्हिगेशन
AI BENCHY
Your ad here

AI BENCHY Compare

OpenAI: GPT-5.4 vs Qwen: Qwen3.6 Flash

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-04-27

मेट्रिक GPT-5.4 GPT-5.4 medium प्रकाशन: 2026-03-05 Qwen3.6 Flash Qwen3.6 Flash medium प्रकाशन: 2026-04-20
स्कोअर 8.2 8.1
क्रमांक #21 #24
विश्वसनीयता लागू नाही 10.0
सुसंगतता 8.7 8.2
बरोबर चाचण्या
प्रति प्रयत्न पास दर 79.6% 79.6%
अस्थिर चाचण्या 3 4
एकूण रन 54 54
प्रति निकाल खर्च 6.399 1.449
एकूण खर्च $0.832 $0.174
???? ??? $2.500 / 1M $0.250 / 1M
????? ??? $15.000 / 1M $1.500 / 1M
आउटपुट टोकन्स 2,169 2,804
रिझनिंग टोकन्स 48,732 107,210
प्रतिसाद वेळ (सरासरी) 18.63s 9.90s
प्रतिसाद वेळ (कमाल) 100.41s 26.85s
प्रतिसाद वेळ (एकूण) 335.26s 178.26s

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.4 8.3 10.0 75.0% 0 4.11s 240 1,511
Qwen3.6 Flash 10.0 10.0 100.0% 0 6.10s 624 14,024
कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.4 10.0 10.0 100.0% 0 13.03s 389 2,045
Qwen3.6 Flash 6.7 3.5 66.7% 1 25.84s 435 17,044
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.4 10.0 10.0 100.0% 0 20.57s 301 3,543
Qwen3.6 Flash 10.0 10.0 100.0% 0 20.28s 483 13,839
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.4 10.0 10.0 100.0% 0 5.32s 234 804
Qwen3.6 Flash 10.0 10.0 100.0% 0 9.65s 270 13,155
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.4 5.3 7.2 44.4% 1 74.27s 61 34,748
Qwen3.6 Flash 3.5 4.4 33.3% 2 14.65s 60 24,409
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.4 4.7 3.1 33.3% 1 4.92s 145 321
Qwen3.6 Flash 4.8 9.9 0.0% 0 9.88s 140 5,445
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.4 10.0 10.0 100.0% 0 3.11s 93 897
Qwen3.6 Flash 10.0 10.0 100.0% 0 6.05s 102 7,423
कोडी सोडवणे स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.4 8.2 7.2 88.9% 1 9.13s 442 3,832
Qwen3.6 Flash 8.2 7.2 88.9% 1 6.17s 355 10,683
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.4 10.0 10.0 100.0% 0 13.28s 264 1,031
Qwen3.6 Flash 10.0 10.0 100.0% 0 4.00s 335 1,188

झटपट तुलना

तुलना जोडी बदला