नेव्हिगेशन
AI BENCHY
Your ad here

AI BENCHY Compare

OpenAI: GPT-5.2 vs Qwen: Qwen3.6 Max Preview

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-04-27

मेट्रिक GPT-5.2 GPT-5.2 medium प्रकाशन: 2025-12-11 Qwen3.6 Max Preview Qwen3.6 Max Preview none प्रकाशन: 2026-04-20
स्कोअर 7.5 7.3
क्रमांक #52 #56
विश्वसनीयता लागू नाही 10.0
सुसंगतता 8.1 8.7
बरोबर चाचण्या
प्रति प्रयत्न पास दर 72.2% 66.7%
अस्थिर चाचण्या 4 3
एकूण रन 54 54
प्रति निकाल खर्च 3.193 0.827
एकूण खर्च $0.352 $0.083
???? ??? $1.750 / 1M $1.300 / 1M
????? ??? $14.000 / 1M $7.800 / 1M
आउटपुट टोकन्स 2,705 4,732
रिझनिंग टोकन्स 18,977 0
प्रतिसाद वेळ (सरासरी) 14.04s 3.38s
प्रतिसाद वेळ (कमाल) 77.80s 20.51s
प्रतिसाद वेळ (एकूण) 154.41s 60.83s

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.2 6.5 8.0 58.3% 1 7.81s 567 2,002
Qwen3.6 Max Preview 5.2 7.9 41.7% 1 2.63s 513 0
कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.2 10.0 10.0 100.0% 0 15.12s 467 2,166
Qwen3.6 Max Preview 5.0 2.0 66.7% 1 3.45s 426 0
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.2 10.0 10.0 100.0% 0 14.06s 291 1,757
Qwen3.6 Max Preview 3.0 10.0 0.0% 0 20.51s 2,842 0
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.2 10.0 10.0 100.0% 0 3.15s 234 420
Qwen3.6 Max Preview 10.0 10.0 100.0% 0 2.87s 243 0
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.2 5.9 7.2 55.6% 1 77.80s 42 10,342
Qwen3.6 Max Preview 7.7 10.0 66.7% 0 1.22s 18 0
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.2 3.7 9.7 0.0% 0 4.32s 162 269
Qwen3.6 Max Preview 4.3 10.0 0.0% 0 1.62s 76 0
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.2 9.9 10.0 100.0% 0 3.12s 94 614
Qwen3.6 Max Preview 8.4 6.9 83.3% 1 1.45s 69 0
कोडी सोडवणे स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.2 7.7 7.3 77.8% 1 5.47s 609 938
Qwen3.6 Max Preview 10.0 10.0 100.0% 0 2.38s 323 0
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.2 4.7 1.6 66.7% 1 10.30s 239 469
Qwen3.6 Max Preview 10.0 10.0 100.0% 0 5.27s 222 0

झटपट तुलना

तुलना जोडी बदला