नेविगेशन
Advertise here

Mercury 2.5 (medium) vs GLM 5.2

average score लगभग बराबर है: 6.8 vs 6.7. Mercury 2.5 (medium) की benchmark लागत कम है: $0.022 vs $0.153. Mercury 2.5 (medium) तेज है: 3.19s vs 9.65s, pass rates 65.2% vs 63.6%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-08

तुलना किए गए मॉडल

रैंक
#157
कुल आउटपुट टोकन
120,129
प्रतिक्रिया समय (औसत)
3.19s
कुल लागत
$0.022
रैंक
#160
कुल आउटपुट टोकन
14,344
प्रतिक्रिया समय (औसत)
9.65s
कुल लागत
$0.153
अनुशंसित मॉडल Mercury 2.5 (medium)

It has the best score here (6.8), while costing about 7.0x less than GLM 5.2.

विस्तृत तुलना

मेट्रिक Mercury 2.5 Mercury 2.5 medium रिलीज़: 2026-09-08 GLM 5.2 GLM 5.2 none रिलीज़: 2026-06-17
स्कोर 6.8 6.7
रैंक #157 #160
विश्वसनीयता 9.8 10.0
संगति 8.6 9.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 65.2% 63.6%
अस्थिर टेस्ट 4 2
कुल रन 66 66
प्रति परिणाम लागत 0.181 1.312
कुल लागत $0.022 $0.153
इनपुट कीमत $0.040 / 1M $0.966 / 1M
आउटपुट कीमत $0.150 / 1M $3.036 / 1M
कुल इनपुट टोकन 91,402 112,458
आउटपुट टोकन 3,138 14,344
रीजनिंग टोकन 116,991 0
प्रतिक्रिया समय (औसत) 3.19s 9.65s
प्रतिक्रिया समय (अधिकतम) 9.87s 79.65s
प्रतिक्रिया समय (कुल) 70.18s 212.38s
पैरामीटर ~100B 744B कुल (40B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#157 Mercury 2.5

medium
लागत
$0.001
समय
3.8s
टोकन
3,386 tok

#160 GLM 5.2

none
लागत
$0.033
समय
87.7s
टोकन
7,455 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Mercury 2.5 5.0 5.1 44.5% 2 3.70s 7,807 488 21,857
GLM 5.2 3.7 9.5 0.0% 0 7.55s 7,263 1,958 0

त्वरित तुलना

तुलना जोड़ी बदलें