नेव्हिगेशन
AI BENCHY
Advertise here

AI BENCHY Compare

OpenAI: GPT-5.3-Codex vs Qwen: Qwen3.7 Plus

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-06-03

मेट्रिक GPT-5.3-Codex GPT-5.3-Codex medium प्रकाशन: 2026-02-05 Qwen3.7 Plus Qwen3.7 Plus medium प्रकाशन: 2026-06-03
स्कोअर 8.3 8.4
क्रमांक #17 #16
विश्वसनीयता 10.0 9.9
सुसंगतता 8.4 9.2
बरोबर चाचण्या
प्रति प्रयत्न पास दर 81.7% 80.0%
अस्थिर चाचण्या 4 2
एकूण रन 60 60
प्रति निकाल खर्च 4.887 1.324
एकूण खर्च $0.685 $0.199
इनपुट किंमत $1.750 / 1M $0.400 / 1M
आउटपुट किंमत $14.000 / 1M $1.600 / 1M
एकूण इनपुट टोकन्स 31,680 38,104
आउटपुट टोकन्स 2,336 2,107
रिझनिंग टोकन्स 42,565 112,479
प्रतिसाद वेळ (सरासरी) 15.95s 36.84s
प्रतिसाद वेळ (कमाल) 100.93s 178.04s
प्रतिसाद वेळ (एकूण) 319.08s 736.86s

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.3-Codex 8.7 7.9 91.7% 1 4.16s 606 240 1,722
Qwen3.7 Plus 10.0 10.0 100.0% 0 8.58s 672 195 5,065
कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.3-Codex 10.0 10.0 100.0% 0 18.45s 4,683 514 7,266
Qwen3.7 Plus 6.5 5.9 66.7% 1 122.40s 3,637 396 30,301
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.3-Codex 10.0 10.0 100.0% 0 19.56s 11,019 364 2,731
Qwen3.7 Plus 10.0 10.0 100.0% 0 65.24s 14,934 366 10,132
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.3-Codex 10.0 10.0 100.0% 0 3.07s 7,140 234 728
Qwen3.7 Plus 10.0 10.0 100.0% 0 21.75s 7,782 270 6,713
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.3-Codex 5.9 7.2 55.6% 1 64.31s 813 64 25,308
Qwen3.7 Plus 3.6 7.2 22.2% 1 45.35s 771 57 27,073
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.3-Codex 4.6 10.0 0.0% 0 4.87s 477 187 331
Qwen3.7 Plus 10.0 10.0 100.0% 0 25.48s 516 123 3,998
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.3-Codex 10.0 10.0 100.0% 0 3.04s 660 93 693
Qwen3.7 Plus 10.0 10.0 100.0% 0 16.13s 699 102 5,013
कोडी सोडवणे स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.3-Codex 9.0 7.9 88.9% 1 5.05s 642 356 1,593
Qwen3.7 Plus 10.0 10.0 100.0% 0 16.38s 696 280 7,312
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.3-Codex 10.0 10.0 100.0% 0 6.37s 5,445 254 492
Qwen3.7 Plus 10.0 10.0 100.0% 0 15.02s 8,193 292 1,831
सामान्य ज्ञान स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.3-Codex 2.8 1.6 33.3% 1 14.43s 195 30 1,701
Qwen3.7 Plus 3.0 10.0 0.0% 0 91.07s 204 26 15,041

झटपट तुलना

तुलना जोडी बदला