नेविगेशन
Advertise here

Mercury 2.5 (high) vs GLM 5.2

GLM 5.2 average score में आगे है: 6.6 vs 6.5. Mercury 2.5 (high) की benchmark लागत कम है: $0.044 vs $0.152. Mercury 2.5 (high) तेज है: 7.62s vs 11.27s, pass rates 59.4% vs 63.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#195
कुल आउटपुट टोकन
193,676
प्रतिक्रिया समय (औसत)
7.62s
कुल लागत
$0.044
रैंक
#186
कुल आउटपुट टोकन
17,685
प्रतिक्रिया समय (औसत)
11.27s
कुल लागत
$0.152
अनुशंसित मॉडल Mercury 2.5 (high)

Its score stays close to the best score here (6.5 vs 6.6), while costing about 3.5x less than GLM 5.2.

विस्तृत तुलना

मेट्रिक Mercury 2.5 Mercury 2.5 high रिलीज़: 2026-09-08 GLM 5.2 GLM 5.2 none रिलीज़: 2026-06-17
स्कोर 6.5 6.6
रैंक #195 #186
विश्वसनीयता 9.8 10.0
संगति 8.7 9.0
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 59.4% 63.8%
अस्थिर टेस्ट 4 3
कुल रन 69 69
प्रति परिणाम लागत 0.362 1.753
कुल लागत $0.044 $0.152
इनपुट कीमत $0.040 / 1M $0.325 / 1M
आउटपुट कीमत $0.150 / 1M $3.990 / 1M
कुल इनपुट टोकन 358,562 247,919
आउटपुट टोकन 4,266 17,685
रीजनिंग टोकन 189,410 0
प्रतिक्रिया समय (औसत) 7.62s 11.27s
प्रतिक्रिया समय (अधिकतम) 80.30s 79.65s
प्रतिक्रिया समय (कुल) 175.36s 259.32s
पैरामीटर ~100B 744B कुल (40B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#195 Mercury 2.5

high
लागत
$0.001
समय
3.5s
टोकन
2,447 tok

#186 GLM 5.2

none
लागत
$0.033
समय
87.7s
टोकन
7,455 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Mercury 2.5 6.4 7.8 44.4% 1 6.58s 7,757 415 44,012
GLM 5.2 3.7 9.5 0.0% 0 7.55s 7,263 1,958 0

त्वरित तुलना

तुलना जोड़ी बदलें