नेविगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Mercury 2.5 (high) vs GPT-5.5

Mercury 2.5 (high) average score में आगे है: 7.1 vs 7.0. Mercury 2.5 (high) की benchmark लागत कम है: $0.031 vs $0.544. GPT-5.5 तेज है: 2.35s vs 4.32s, pass rates 62.1% vs 59.1%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-08

तुलना किए गए मॉडल

रैंक
#134
कुल आउटपुट टोकन
174,547
प्रतिक्रिया समय (औसत)
4.32s
कुल लागत
$0.031
रैंक
#139
कुल आउटपुट टोकन
4,915
प्रतिक्रिया समय (औसत)
2.35s
कुल लागत
$0.544
अनुशंसित मॉडल Mercury 2.5 (high)

It has the best score here (7.1), while costing about 17.6x less than GPT-5.5.

विस्तृत तुलना

मेट्रिक Mercury 2.5 Mercury 2.5 high रिलीज़: 2026-09-08 GPT-5.5 GPT-5.5 none रिलीज़: 2026-04-24
स्कोर 7.1 7.0
रैंक #134 #139
विश्वसनीयता 9.7 10.0
संगति 8.6 9.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 62.1% 59.1%
अस्थिर टेस्ट 4 2
कुल रन 66 66
प्रति परिणाम लागत 0.259 4.533
कुल लागत $0.031 $0.544
इनपुट कीमत $0.040 / 1M $5.000 / 1M
आउटपुट कीमत $0.150 / 1M $30.000 / 1M
कुल इनपुट टोकन 120,068 79,294
आउटपुट टोकन 3,402 4,915
रीजनिंग टोकन 171,145 0
प्रतिक्रिया समय (औसत) 4.32s 2.35s
प्रतिक्रिया समय (अधिकतम) 23.63s 12.24s
प्रतिक्रिया समय (कुल) 95.06s 51.78s
पैरामीटर ~100B ~1.5T कुल (~100B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#134 Mercury 2.5

high
लागत
$0.001
समय
3.5s
टोकन
2,447 tok

#139 GPT-5.5

none
लागत
$0.090
समय
54.3s
टोकन
3,063 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Mercury 2.5 6.4 7.8 44.4% 1 6.58s 7,757 415 44,012
GPT-5.5 5.5 10.0 33.3% 0 1.35s 7,305 462 0

त्वरित तुलना

तुलना जोड़ी बदलें