नेव्हिगेशन
Advertise here

Mercury 2.5 (medium) vs GLM 5.2

average score जवळपास समान आहे: 6.8 vs 6.7. Mercury 2.5 (medium) चा benchmark खर्च कमी आहे: $0.022 vs $0.153. Mercury 2.5 (medium) वेगवान आहे: 3.19s vs 9.65s, pass rates 65.2% vs 63.6%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-09-08

तुलना केलेली मॉडेल्स

क्रमांक
#157
एकूण आउटपुट टोकन्स
120,129
प्रतिसाद वेळ (सरासरी)
3.19s
एकूण खर्च
$0.022
क्रमांक
#160
एकूण आउटपुट टोकन्स
14,344
प्रतिसाद वेळ (सरासरी)
9.65s
एकूण खर्च
$0.153
शिफारस केलेले मॉडेल Mercury 2.5 (medium)

It has the best score here (6.8), while costing about 7.0x less than GLM 5.2.

तपशीलवार तुलना

मेट्रिक Mercury 2.5 Mercury 2.5 medium प्रकाशन: 2026-09-08 GLM 5.2 GLM 5.2 none प्रकाशन: 2026-06-17
स्कोअर 6.8 6.7
क्रमांक #157 #160
विश्वसनीयता 9.8 10.0
सुसंगतता 8.6 9.2
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 65.2% 63.6%
अस्थिर चाचण्या 4 2
एकूण रन 66 66
प्रति निकाल खर्च 0.181 1.312
एकूण खर्च $0.022 $0.153
इनपुट किंमत $0.040 / 1M $0.966 / 1M
आउटपुट किंमत $0.150 / 1M $3.036 / 1M
एकूण इनपुट टोकन्स 91,402 112,458
आउटपुट टोकन्स 3,138 14,344
रिझनिंग टोकन्स 116,991 0
प्रतिसाद वेळ (सरासरी) 3.19s 9.65s
प्रतिसाद वेळ (कमाल) 9.87s 79.65s
प्रतिसाद वेळ (एकूण) 70.18s 212.38s
पॅरामीटर्स ~100B 744B एकूण (40B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#157 Mercury 2.5

medium
खर्च
$0.001
वेळ
3.8s
टोकन्स
3,386 tok

#160 GLM 5.2

none
खर्च
$0.033
वेळ
87.7s
टोकन्स
7,455 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Mercury 2.5 5.0 5.1 44.5% 2 3.70s 7,807 488 21,857
GLM 5.2 3.7 9.5 0.0% 0 7.55s 7,263 1,958 0

झटपट तुलना

तुलना जोडी बदला