नेविगेशन
AI BENCHY
Advertise here

Claude Opus 5 vs OpenAI: GPT-5.3-Codex

GPT-5.3-Codex (medium) average score में आगे है: 8.9 vs 8.6. GPT-5.3-Codex (medium) की benchmark लागत कम है: $0.920 vs $1.121. Claude Opus 5 (low) तेज है: 6.99s vs 16.96s, pass rates 80.3% vs 83.3%.

अनुशंसित मॉडलGPT-5.3-Codex (medium)It has the strongest score in this comparison (8.9) and the best overall balance of cost and response time across all 2 models.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

मेट्रिक Claude Opus 5 Claude Opus 5 low रिलीज़: 2026-07-25 GPT-5.3-Codex GPT-5.3-Codex medium रिलीज़: 2026-02-05
स्कोर 8.6 8.9
रैंक #23 #18
विश्वसनीयता 10.0 10.0
संगति 9.3 8.6
सही परीक्षण
प्रति प्रयास पास दर 80.3% 83.3%
अस्थिर टेस्ट 2 4
कुल रन 66 66
प्रति परिणाम लागत 6.593 5.748
कुल लागत $1.121 $0.920
इनपुट कीमत $5.000 / 1M $1.750 / 1M
आउटपुट कीमत $25.000 / 1M $14.000 / 1M
कुल इनपुट टोकन 134,773 81,268
आउटपुट टोकन 14,123 6,251
रीजनिंग टोकन 3,896 49,274
प्रतिक्रिया समय (औसत) 6.99s 16.96s
प्रतिक्रिया समय (अधिकतम) 30.67s 100.93s
प्रतिक्रिया समय (कुल) 153.73s 373.19s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#23 Claude Opus 5

low
लागत
$0.062
समय
30.2s
टोकन
2,615 tok

#18 GPT-5.3-Codex

medium
लागत
$0.049
समय
54.9s
टोकन
3,580 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Opus 5 7.8 7.4 77.8% 1 6.70s 10,590 2,442 760
GPT-5.3-Codex 10.0 10.0 100.0% 0 19.50s 7,302 535 10,890

त्वरित तुलना

तुलना जोड़ी बदलें