नेव्हिगेशन
Advertise here

Mercury 2.5 (medium) vs GLM 5.3 (low)

average score जवळपास समान आहे: 6.8 vs 6.8. Mercury 2.5 (medium) चा benchmark खर्च कमी आहे: $0.022 vs $0.257. Mercury 2.5 (medium) वेगवान आहे: 3.19s vs 13.65s, pass rates 65.2% vs 65.2%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-09-08

तुलना केलेली मॉडेल्स

क्रमांक
#157
एकूण आउटपुट टोकन्स
120,129
प्रतिसाद वेळ (सरासरी)
3.19s
एकूण खर्च
$0.022
क्रमांक
#155
एकूण आउटपुट टोकन्स
24,808
प्रतिसाद वेळ (सरासरी)
13.65s
एकूण खर्च
$0.257
शिफारस केलेले मॉडेल Mercury 2.5 (medium)

It has the best score here (6.8), while costing about 11.8x less than GLM 5.3 (low).

तपशीलवार तुलना

मेट्रिक Mercury 2.5 Mercury 2.5 medium प्रकाशन: 2026-09-08 GLM 5.3 GLM 5.3 low प्रकाशन: 2026-08-20
स्कोअर 6.8 6.8
क्रमांक #157 #155
विश्वसनीयता 9.8 10.0
सुसंगतता 8.6 8.5
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 65.2% 65.2%
अस्थिर चाचण्या 4 4
एकूण रन 66 66
प्रति निकाल खर्च 0.181 2.135
एकूण खर्च $0.022 $0.257
इनपुट किंमत $0.040 / 1M $1.400 / 1M
आउटपुट किंमत $0.150 / 1M $4.400 / 1M
एकूण इनपुट टोकन्स 91,402 104,989
आउटपुट टोकन्स 3,138 8,532
रिझनिंग टोकन्स 116,991 16,276
प्रतिसाद वेळ (सरासरी) 3.19s 13.65s
प्रतिसाद वेळ (कमाल) 9.87s 83.60s
प्रतिसाद वेळ (एकूण) 70.18s 300.22s
पॅरामीटर्स ~100B 744B एकूण (40B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#157 Mercury 2.5

medium
खर्च
$0.001
वेळ
3.8s
टोकन्स
3,386 tok

#155 GLM 5.3

low
खर्च
$0.007
वेळ
28.4s
टोकन्स
1,599 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Mercury 2.5 5.0 5.1 44.5% 2 3.70s 7,807 488 21,857
GLM 5.3 6.2 6.9 55.6% 1 21.02s 7,317 368 6,764

झटपट तुलना

तुलना जोडी बदला