नेविगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-5.5 (medium) vs Pareto

GPT-5.5 (medium) average score में आगे है: 9.0 vs 8.9. Pareto की benchmark लागत कम है: $1.172 vs $4.163. Pareto तेज है: 31.51s vs 38.97s, pass rates 87.9% vs 86.4%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-18

तुलना किए गए मॉडल

रैंक
#28
कुल आउटपुट टोकन
125,316
प्रतिक्रिया समय (औसत)
38.97s
कुल लागत
$4.163
रैंक
#34
कुल आउटपुट टोकन
119,230
प्रतिक्रिया समय (औसत)
31.51s
कुल लागत
$1.172
अनुशंसित मॉडल Pareto

Its score stays close to the best score here (8.9 vs 9.0), while costing about 3.6x less than GPT-5.5 (medium).

विस्तृत तुलना

मेट्रिक GPT-5.5 GPT-5.5 medium रिलीज़: 2026-04-24 Pareto Pareto none रिलीज़: 2026-09-18
स्कोर 9.0 8.9
रैंक #28 #34
विश्वसनीयता 10.0 10.0
संगति 8.9 9.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 87.9% 86.4%
अस्थिर टेस्ट 3 2
कुल रन 66 66
प्रति परिणाम लागत 23.127 6.506
कुल लागत $4.163 $1.172
इनपुट कीमत $5.000 / 1M $2.500 / 1M
आउटपुट कीमत $30.000 / 1M $7.500 / 1M
कुल इनपुट टोकन 80,668 110,734
आउटपुट टोकन 5,617 119,230
रीजनिंग टोकन 119,699 0
प्रतिक्रिया समय (औसत) 38.97s 31.51s
प्रतिक्रिया समय (अधिकतम) 332.10s 143.33s
प्रतिक्रिया समय (कुल) 857.43s 693.29s
पैरामीटर ~1.5T कुल (~100B सक्रिय) -
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#28 GPT-5.5

medium
लागत
$0.112
समय
71.9s
टोकन
3,807 tok

#34 Pareto

none
लागत
$0.034
समय
170.7s
टोकन
4,581 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.5 8.8 7.8 88.9% 1 59.77s 7,305 362 24,959
Pareto 10.0 10.0 100.0% 0 50.12s 7,471 1,949 0

त्वरित तुलना

तुलना जोड़ी बदलें