नेव्हिगेशन
AI BENCHY
Advertise here

OpenAI: GPT-5.3-Codex vs Qwen: Qwen3.7 Max

GPT-5.3-Codex (medium) average score मध्ये पुढे आहे: 8.9 vs 7.4. Qwen3.7 Max चा benchmark खर्च कमी आहे: $0.197 vs $0.920. Qwen3.7 Max वेगवान आहे: 4.52s vs 16.96s, pass rates 83.3% vs 68.2%.

शिफारस केलेले मॉडेलQwen3.7 MaxIt offers the best overall trade-off: a competitive score (7.4), lower cost than GPT-5.3-Codex (medium), and balanced response time.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-25

मेट्रिक GPT-5.3-Codex GPT-5.3-Codex medium प्रकाशन: 2026-02-05 Qwen3.7 Max Qwen3.7 Max none प्रकाशन: 2026-05-22
स्कोअर 8.9 7.4
क्रमांक #18 #67
विश्वसनीयता 10.0 9.9
सुसंगतता 8.6 10.0
बरोबर चाचण्या
प्रति प्रयत्न पास दर 83.3% 68.2%
अस्थिर चाचण्या 4 0
एकूण रन 66 66
प्रति निकाल खर्च 5.748 1.582
एकूण खर्च $0.920 $0.197
इनपुट किंमत $1.750 / 1M $1.475 / 1M
आउटपुट किंमत $14.000 / 1M $4.425 / 1M
एकूण इनपुट टोकन्स 81,268 95,983
आउटपुट टोकन्स 6,251 12,446
रिझनिंग टोकन्स 49,274 0
प्रतिसाद वेळ (सरासरी) 16.96s 4.52s
प्रतिसाद वेळ (कमाल) 100.93s 72.30s
प्रतिसाद वेळ (एकूण) 373.19s 99.52s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#18 GPT-5.3-Codex

medium
खर्च
$0.049
वेळ
54.9s
टोकन्स
3,580 tok

#67 Qwen3.7 Max

none
खर्च
$0.046
वेळ
195.0s
टोकन्स
12,171 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.3-Codex 10.0 10.0 100.0% 0 19.50s 7,302 535 10,890
Qwen3.7 Max 5.5 10.0 33.3% 0 1.35s 7,911 582 0

झटपट तुलना

तुलना जोडी बदला