नेविगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Mercury 2.5 (high) vs GLM 5.3 (low)

average score लगभग बराबर है: 6.5 vs 6.5. Mercury 2.5 (high) की benchmark लागत कम है: $0.044 vs $0.473. Mercury 2.5 (high) तेज है: 7.62s vs 15.28s, pass rates 59.4% vs 63.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#194
कुल आउटपुट टोकन
193,676
प्रतिक्रिया समय (औसत)
7.62s
कुल लागत
$0.044
रैंक
#195
कुल आउटपुट टोकन
28,602
प्रतिक्रिया समय (औसत)
15.28s
कुल लागत
$0.473
अनुशंसित मॉडल Mercury 2.5 (high)

It has the best score here (6.5), while costing about 10.9x less than GLM 5.3 (low).

विस्तृत तुलना

मेट्रिक Mercury 2.5 Mercury 2.5 high रिलीज़: 2026-09-08 GLM 5.3 GLM 5.3 low रिलीज़: 2026-08-20
स्कोर 6.5 6.5
रैंक #194 #195
विश्वसनीयता 9.8 10.0
संगति 8.7 8.3
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 59.4% 63.8%
अस्थिर टेस्ट 4 5
कुल रन 69 69
प्रति परिणाम लागत 0.362 3.936
कुल लागत $0.044 $0.473
इनपुट कीमत $0.040 / 1M $1.400 / 1M
आउटपुट कीमत $0.150 / 1M $4.400 / 1M
कुल इनपुट टोकन 358,562 247,436
आउटपुट टोकन 4,266 11,005
रीजनिंग टोकन 189,410 17,597
प्रतिक्रिया समय (औसत) 7.62s 15.28s
प्रतिक्रिया समय (अधिकतम) 80.30s 83.60s
प्रतिक्रिया समय (कुल) 175.36s 351.49s
पैरामीटर ~100B 744B कुल (40B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#194 Mercury 2.5

high
लागत
$0.001
समय
3.5s
टोकन
2,447 tok

#195 GLM 5.3

low
लागत
$0.007
समय
28.4s
टोकन
1,599 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Mercury 2.5 6.4 7.8 44.4% 1 6.58s 7,757 415 44,012
GLM 5.3 6.2 6.9 55.6% 1 21.02s 7,317 368 6,764

त्वरित तुलना

तुलना जोड़ी बदलें