नेव्हिगेशन
AI BENCHY
Advertise here

OpenAI: GPT-5.3 Chat vs Qwen: Qwen3.7 Max

GPT-5.3 Chat average score मध्ये पुढे आहे: 7.5 vs 7.4. Qwen3.7 Max चा benchmark खर्च कमी आहे: $0.197 vs $0.571. Qwen3.7 Max वेगवान आहे: 4.52s vs 6.88s, pass rates 68.2% vs 68.2%.

शिफारस केलेले मॉडेलQwen3.7 MaxIts score stays close to the best score here (7.4 vs 7.5), while costing about 2.9x less than GPT-5.3 Chat.
क्रमांक
#62
प्रति प्रयत्न पास दर
68.2%
एकूण आउटपुट टोकन्स
30,854
प्रतिसाद वेळ (सरासरी)
6.88s
एकूण खर्च
$0.571
क्रमांक
#67
प्रति प्रयत्न पास दर
68.2%
एकूण आउटपुट टोकन्स
12,446
प्रतिसाद वेळ (सरासरी)
4.52s
एकूण खर्च
$0.197

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-25

मेट्रिक GPT-5.3 Chat GPT-5.3 Chat none प्रकाशन: 2026-03-03 Qwen3.7 Max Qwen3.7 Max none प्रकाशन: 2026-05-22
स्कोअर 7.5 7.4
क्रमांक #62 #67
विश्वसनीयता 10.0 9.9
सुसंगतता 8.2 10.0
बरोबर चाचण्या
प्रति प्रयत्न पास दर 68.2% 68.2%
अस्थिर चाचण्या 5 0
एकूण रन 66 66
प्रति निकाल खर्च 4.387 1.582
एकूण खर्च $0.571 $0.197
इनपुट किंमत $1.750 / 1M $1.475 / 1M
आउटपुट किंमत $14.000 / 1M $4.425 / 1M
एकूण इनपुट टोकन्स 78,990 95,983
आउटपुट टोकन्स 30,854 12,446
रिझनिंग टोकन्स 0 0
प्रतिसाद वेळ (सरासरी) 6.88s 4.52s
प्रतिसाद वेळ (कमाल) 18.33s 72.30s
प्रतिसाद वेळ (एकूण) 151.31s 99.52s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#62 GPT-5.3 Chat

none
खर्च
$0.008
वेळ
8.1s
टोकन्स
634 tok

#67 Qwen3.7 Max

none
खर्च
$0.046
वेळ
195.0s
टोकन्स
12,171 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.3 Chat 5.6 4.7 55.6% 2 10.52s 7,302 6,632 0
Qwen3.7 Max 5.5 10.0 33.3% 0 1.35s 7,911 582 0

झटपट तुलना

तुलना जोडी बदला