नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-5.3-Codex (medium) vs Qwen3.8 Max (0902) (high)

average score जवळपास समान आहे: 8.9 vs 8.9. GPT-5.3-Codex (medium) चा benchmark खर्च कमी आहे: $0.988 vs $2.736. GPT-5.3-Codex (medium) वेगवान आहे: 16.91s vs 185.56s, pass rates 83.3% vs 86.4%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-09-07

क्रमांक
#32
एकूण आउटपुट टोकन्स
60,374
प्रतिसाद वेळ (सरासरी)
16.91s
एकूण खर्च
$0.988
क्रमांक
#31
एकूण आउटपुट टोकन्स
419,443
प्रतिसाद वेळ (सरासरी)
185.56s
एकूण खर्च
$2.736
शिफारस केलेले मॉडेल GPT-5.3-Codex (medium)

It has the best score here (8.9), while costing about 2.8x less than Qwen3.8 Max (0902) (high).

तपशीलवार तुलना

मेट्रिक GPT-5.3-Codex GPT-5.3-Codex medium प्रकाशन: 2026-02-05 Qwen3.8 Max (0902) Qwen3.8 Max (0902) high प्रकाशन: 2026-09-07
स्कोअर 8.9 8.9
क्रमांक #32 #31
विश्वसनीयता 10.0 9.8
सुसंगतता 8.6 9.0
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 83.3% 86.4%
अस्थिर चाचण्या 4 3
एकूण रन 66 66
प्रति निकाल खर्च 6.171 16.089
एकूण खर्च $0.988 $2.736
इनपुट किंमत $1.750 / 1M $2.000 / 1M
आउटपुट किंमत $14.000 / 1M $6.000 / 1M
एकूण इनपुट टोकन्स 81,187 109,226
आउटपुट टोकन्स 6,258 6,890
रिझनिंग टोकन्स 54,116 412,553
प्रतिसाद वेळ (सरासरी) 16.91s 185.56s
प्रतिसाद वेळ (कमाल) 100.93s 912.78s
प्रतिसाद वेळ (एकूण) 372.03s 4082.41s
पॅरामीटर्स ~1.2T एकूण (~80B सक्रिय) 2.4T एकूण (~100B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#32 GPT-5.3-Codex

medium
खर्च
$0.049
वेळ
54.9s
टोकन्स
3,580 tok

#31 Qwen3.8 Max (0902)

high
Reached the allocated time limit (600 seconds) without receiving showcase output.
खर्च
$0.000
वेळ
600.0s
टोकन्स
0 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.3-Codex 10.0 10.0 100.0% 0 19.50s 7,302 535 10,890
Qwen3.8 Max (0902) 10.0 10.0 100.0% 0 253.22s 8,235 418 91,734

झटपट तुलना

तुलना जोडी बदला