नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

OpenAI: GPT-5.3-Codex vs Qwen: Qwen3.6 Flash

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-04-27

मेट्रिक GPT-5.3-Codex GPT-5.3-Codex medium प्रकाशन: 2026-02-05 Qwen3.6 Flash Qwen3.6 Flash medium प्रकाशन: 2026-04-20
स्कोअर 8.6 8.1
क्रमांक #11 #24
विश्वसनीयता लागू नाही 10.0
सुसंगतता 8.7 8.2
बरोबर चाचण्या
प्रति प्रयत्न पास दर 83.3% 79.6%
अस्थिर चाचण्या 3 4
एकूण रन 54 54
प्रति निकाल खर्च 4.405 1.449
एकूण खर्च $0.573 $0.174
???? ??? $1.750 / 1M $0.250 / 1M
????? ??? $14.000 / 1M $1.500 / 1M
आउटपुट टोकन्स 2,279 2,804
रिझनिंग टोकन्स 35,179 107,210
प्रतिसाद वेळ (सरासरी) 15.38s 9.90s
प्रतिसाद वेळ (कमाल) 100.93s 26.85s
प्रतिसाद वेळ (एकूण) 276.91s 178.26s

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.3-Codex 8.7 7.9 91.7% 1 4.16s 240 1,722
Qwen3.6 Flash 10.0 10.0 100.0% 0 6.10s 624 14,024
कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.3-Codex 10.0 10.0 100.0% 0 8.95s 491 1,530
Qwen3.6 Flash 6.7 3.5 66.7% 1 25.84s 435 17,044
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.3-Codex 10.0 10.0 100.0% 0 19.56s 364 2,731
Qwen3.6 Flash 10.0 10.0 100.0% 0 20.28s 483 13,839
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.3-Codex 10.0 10.0 100.0% 0 3.07s 234 728
Qwen3.6 Flash 10.0 10.0 100.0% 0 9.65s 270 13,155
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.3-Codex 5.9 7.2 55.6% 1 64.31s 64 25,308
Qwen3.6 Flash 3.5 4.4 33.3% 2 14.65s 60 24,409
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.3-Codex 4.6 10.0 0.0% 0 4.87s 187 331
Qwen3.6 Flash 4.8 9.9 0.0% 0 9.88s 140 5,445
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.3-Codex 10.0 10.0 100.0% 0 3.04s 93 693
Qwen3.6 Flash 10.0 10.0 100.0% 0 6.05s 102 7,423
कोडी सोडवणे स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.3-Codex 9.0 7.9 88.9% 1 5.12s 352 1,644
Qwen3.6 Flash 8.2 7.2 88.9% 1 6.17s 355 10,683
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.3-Codex 10.0 10.0 100.0% 0 6.37s 254 492
Qwen3.6 Flash 10.0 10.0 100.0% 0 4.00s 335 1,188

झटपट तुलना

तुलना जोडी बदला