नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

OpenAI: GPT-5.3-Codex vs Qwen: Qwen3.7 Max

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-05-22

मेट्रिक GPT-5.3-Codex GPT-5.3-Codex medium प्रकाशन: 2026-02-05 Qwen3.7 Max Qwen3.7 Max medium प्रकाशन: 2026-05-22
स्कोअर 8.3 9.0
क्रमांक #15 #5
विश्वसनीयता 10.0 10.0
सुसंगतता 8.4 9.6
बरोबर चाचण्या
प्रति प्रयत्न पास दर 81.7% 88.3%
अस्थिर चाचण्या 4 1
एकूण रन 60 60
प्रति निकाल खर्च 4.891 5.540
एकूण खर्च $0.685 $0.942
???? ??? $1.750 / 1M $2.500 / 1M
????? ??? $14.000 / 1M $7.500 / 1M
आउटपुट टोकन्स 2,332 2,109
रिझनिंग टोकन्स 42,616 110,285
प्रतिसाद वेळ (सरासरी) 15.97s 13.83s
प्रतिसाद वेळ (कमाल) 100.93s 33.37s
प्रतिसाद वेळ (एकूण) 319.30s 276.53s

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.3-Codex 8.7 7.9 91.7% 1 4.16s 240 1,722
Qwen3.7 Max 10.0 10.0 100.0% 0 6.36s 222 8,742
कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.3-Codex 10.0 10.0 100.0% 0 18.45s 514 7,266
Qwen3.7 Max 10.0 10.0 100.0% 0 22.98s 403 22,134
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.3-Codex 10.0 10.0 100.0% 0 19.56s 364 2,731
Qwen3.7 Max 10.0 10.0 100.0% 0 19.60s 366 8,405
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.3-Codex 10.0 10.0 100.0% 0 3.07s 234 728
Qwen3.7 Max 10.0 10.0 100.0% 0 8.80s 270 6,254
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.3-Codex 5.9 7.2 55.6% 1 64.31s 64 25,308
Qwen3.7 Max 5.9 7.2 55.6% 1 24.94s 61 31,793
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.3-Codex 4.6 10.0 0.0% 0 4.87s 187 331
Qwen3.7 Max 10.0 10.0 100.0% 0 11.70s 135 4,457
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.3-Codex 10.0 10.0 100.0% 0 3.04s 93 693
Qwen3.7 Max 10.0 10.0 100.0% 0 7.46s 102 5,452
कोडी सोडवणे स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.3-Codex 9.0 7.9 88.9% 1 5.12s 352 1,644
Qwen3.7 Max 10.0 10.0 100.0% 0 8.84s 259 8,908
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.3-Codex 10.0 10.0 100.0% 0 6.37s 254 492
Qwen3.7 Max 10.0 10.0 100.0% 0 6.63s 267 1,220
सामान्य ज्ञान स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.3-Codex 2.8 1.6 33.3% 1 14.43s 30 1,701
Qwen3.7 Max 3.0 10.0 0.0% 0 33.37s 24 12,920

झटपट तुलना

तुलना जोडी बदला