नेव्हिगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Claude Opus 5.5 (medium) vs GPT-5.3-Codex (medium)

Claude Opus 5.5 (medium) average score मध्ये पुढे आहे: 9.2 vs 9.1. GPT-5.3-Codex (medium) चा benchmark खर्च कमी आहे: $1.318 vs $1.804. GPT-5.3-Codex (medium) वेगवान आहे: 18.87s vs 25.85s, pass rates 89.9% vs 84.1%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-07

तुलना केलेली मॉडेल्स

क्रमांक
#29
एकूण आउटपुट टोकन्स
32,127
प्रतिसाद वेळ (सरासरी)
25.85s
एकूण खर्च
$1.804
क्रमांक
#34
एकूण आउटपुट टोकन्स
66,287
प्रतिसाद वेळ (सरासरी)
18.87s
एकूण खर्च
$1.318
शिफारस केलेले मॉडेल GPT-5.3-Codex (medium)

It offers the best overall trade-off: a competitive score (9.1), lower cost than Claude Opus 5.5 (medium), and balanced response time.

तपशीलवार तुलना

मेट्रिक Claude Opus 5.5 Claude Opus 5.5 medium प्रकाशन: 2026-09-23 GPT-5.3-Codex GPT-5.3-Codex medium प्रकाशन: 2026-02-05
स्कोअर 9.2 9.1
क्रमांक #29 #34
विश्वसनीयता 10.0 10.0
सुसंगतता 9.7 8.6
प्रयत्न 69/69 69/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 89.9% 84.1%
अस्थिर चाचण्या 1 4
एकूण रन 69 69
प्रति निकाल खर्च 9.016 7.753
एकूण खर्च $1.804 $1.318
इनपुट किंमत $4.000 / 1M $1.750 / 1M
आउटपुट किंमत $20.000 / 1M $14.000 / 1M
कॅश वाचण्याची किंमत $0.200 / 1M $0.175 / 1M
कॅश लिहिण्याची किंमत $5.000 / 1M लागू नाही
एकूण इनपुट टोकन्स 290,117 222,794
आउटपुट टोकन्स 9,805 7,357
रिझनिंग टोकन्स 22,322 58,930
प्रतिसाद वेळ (सरासरी) 25.85s 18.87s
प्रतिसाद वेळ (कमाल) 90.20s 100.93s
प्रतिसाद वेळ (एकूण) 594.63s 433.94s
पॅरामीटर्स ~5T एकूण (~500B सक्रिय) ~1.2T एकूण (~80B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#29 Claude Opus 5.5

medium
खर्च
$0.053
वेळ
25.6s
टोकन्स
2,781 tok

#34 GPT-5.3-Codex

medium
खर्च
$0.049
वेळ
54.9s
टोकन्स
3,580 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 5.5 8.4 7.4 88.9% 1 13.50s 10,608 636 4,341
GPT-5.3-Codex 10.0 10.0 100.0% 0 19.50s 7,302 535 10,890

तुलना जोडी बदला