नेविगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-5.3-Codex (medium) vs Pareto

average score लगभग बराबर है: 8.9 vs 8.9. GPT-5.3-Codex (medium) की benchmark लागत कम है: $0.988 vs $1.172. GPT-5.3-Codex (medium) तेज है: 16.91s vs 31.51s, pass rates 83.3% vs 86.4%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-18

तुलना किए गए मॉडल

रैंक
#32
कुल आउटपुट टोकन
60,374
प्रतिक्रिया समय (औसत)
16.91s
कुल लागत
$0.988
रैंक
#34
कुल आउटपुट टोकन
119,230
प्रतिक्रिया समय (औसत)
31.51s
कुल लागत
$1.172
अनुशंसित मॉडल GPT-5.3-Codex (medium)

It has the best score here (8.9), while responding about 1.9x faster than Pareto.

विस्तृत तुलना

मेट्रिक GPT-5.3-Codex GPT-5.3-Codex medium रिलीज़: 2026-02-05 Pareto Pareto none रिलीज़: 2026-09-18
स्कोर 8.9 8.9
रैंक #32 #34
विश्वसनीयता 10.0 10.0
संगति 8.6 9.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 83.3% 86.4%
अस्थिर टेस्ट 4 2
कुल रन 66 66
प्रति परिणाम लागत 6.171 6.506
कुल लागत $0.988 $1.172
इनपुट कीमत $1.750 / 1M $2.500 / 1M
आउटपुट कीमत $14.000 / 1M $7.500 / 1M
कुल इनपुट टोकन 81,187 110,734
आउटपुट टोकन 6,258 119,230
रीजनिंग टोकन 54,116 0
प्रतिक्रिया समय (औसत) 16.91s 31.51s
प्रतिक्रिया समय (अधिकतम) 100.93s 143.33s
प्रतिक्रिया समय (कुल) 372.03s 693.29s
पैरामीटर ~1.2T कुल (~80B सक्रिय) -
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#32 GPT-5.3-Codex

medium
लागत
$0.049
समय
54.9s
टोकन
3,580 tok

#34 Pareto

none
लागत
$0.034
समय
170.7s
टोकन
4,581 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.3-Codex 10.0 10.0 100.0% 0 19.50s 7,302 535 10,890
Pareto 10.0 10.0 100.0% 0 50.12s 7,471 1,949 0

त्वरित तुलना

तुलना जोड़ी बदलें