नेविगेशन
Advertise here

Claude Opus 5.5 (medium) vs GPT-5.3-Codex (medium)

Claude Opus 5.5 (medium) average score में आगे है: 9.2 vs 9.1. GPT-5.3-Codex (medium) की benchmark लागत कम है: $1.318 vs $1.804. GPT-5.3-Codex (medium) तेज है: 18.87s vs 25.85s, pass rates 89.9% vs 84.1%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-07

तुलना किए गए मॉडल

रैंक
#29
कुल आउटपुट टोकन
32,127
प्रतिक्रिया समय (औसत)
25.85s
कुल लागत
$1.804
रैंक
#34
कुल आउटपुट टोकन
66,287
प्रतिक्रिया समय (औसत)
18.87s
कुल लागत
$1.318
अनुशंसित मॉडल GPT-5.3-Codex (medium)

It offers the best overall trade-off: a competitive score (9.1), lower cost than Claude Opus 5.5 (medium), and balanced response time.

विस्तृत तुलना

मेट्रिक Claude Opus 5.5 Claude Opus 5.5 medium रिलीज़: 2026-09-23 GPT-5.3-Codex GPT-5.3-Codex medium रिलीज़: 2026-02-05
स्कोर 9.2 9.1
रैंक #29 #34
विश्वसनीयता 10.0 10.0
संगति 9.7 8.6
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 89.9% 84.1%
अस्थिर टेस्ट 1 4
कुल रन 69 69
प्रति परिणाम लागत 9.016 7.753
कुल लागत $1.804 $1.318
इनपुट कीमत $4.000 / 1M $1.750 / 1M
आउटपुट कीमत $20.000 / 1M $14.000 / 1M
कैश पढ़ने की कीमत $0.200 / 1M $0.175 / 1M
कैश लिखने की कीमत $5.000 / 1M लागू नहीं
कुल इनपुट टोकन 290,117 222,794
आउटपुट टोकन 9,805 7,357
रीजनिंग टोकन 22,322 58,930
प्रतिक्रिया समय (औसत) 25.85s 18.87s
प्रतिक्रिया समय (अधिकतम) 90.20s 100.93s
प्रतिक्रिया समय (कुल) 594.63s 433.94s
पैरामीटर ~5T कुल (~500B सक्रिय) ~1.2T कुल (~80B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#29 Claude Opus 5.5

medium
लागत
$0.053
समय
25.6s
टोकन
2,781 tok

#34 GPT-5.3-Codex

medium
लागत
$0.049
समय
54.9s
टोकन
3,580 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Opus 5.5 8.4 7.4 88.9% 1 13.50s 10,608 636 4,341
GPT-5.3-Codex 10.0 10.0 100.0% 0 19.50s 7,302 535 10,890

तुलना जोड़ी बदलें