नेविगेशन
AI BENCHY
Advertise here

GPT-5.3-Codex (medium) vs GPT-5.5 (medium)

GPT-5.5 (medium) average score में आगे है: 9.0 vs 8.9. GPT-5.3-Codex (medium) की benchmark लागत कम है: $0.988 vs $4.163. GPT-5.3-Codex (medium) तेज है: 16.91s vs 38.97s, pass rates 83.3% vs 87.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-20

रैंक
#22
कुल आउटपुट टोकन
60,374
प्रतिक्रिया समय (औसत)
16.91s
कुल लागत
$0.988
रैंक
#19
कुल आउटपुट टोकन
125,316
प्रतिक्रिया समय (औसत)
38.97s
कुल लागत
$4.163
अनुशंसित मॉडल GPT-5.3-Codex (medium)

Its score stays close to the best score here (8.9 vs 9.0), while costing about 4.2x less than GPT-5.5 (medium).

विस्तृत तुलना

मेट्रिक GPT-5.3-Codex GPT-5.3-Codex medium रिलीज़: 2026-02-05 GPT-5.5 GPT-5.5 medium रिलीज़: 2026-04-24
स्कोर 8.9 9.0
रैंक #22 #19
विश्वसनीयता 10.0 10.0
संगति 8.6 8.9
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 83.3% 87.9%
अस्थिर टेस्ट 4 3
कुल रन 66 66
प्रति परिणाम लागत 6.171 23.127
कुल लागत $0.988 $4.163
इनपुट कीमत $1.750 / 1M $5.000 / 1M
आउटपुट कीमत $14.000 / 1M $30.000 / 1M
कुल इनपुट टोकन 81,187 80,668
आउटपुट टोकन 6,258 5,617
रीजनिंग टोकन 54,116 119,699
प्रतिक्रिया समय (औसत) 16.91s 38.97s
प्रतिक्रिया समय (अधिकतम) 100.93s 332.10s
प्रतिक्रिया समय (कुल) 372.03s 857.43s
पैरामीटर ~1.2T कुल (~80B सक्रिय) ~1.5T कुल (~100B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#22 GPT-5.3-Codex

medium
लागत
$0.049
समय
54.9s
टोकन
3,580 tok

#19 GPT-5.5

medium
लागत
$0.112
समय
71.9s
टोकन
3,807 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.3-Codex 10.0 10.0 100.0% 0 19.50s 7,302 535 10,890
GPT-5.5 8.8 7.8 88.9% 1 59.77s 7,305 362 24,959

त्वरित तुलना

तुलना जोड़ी बदलें