नेव्हिगेशन
Advertise here

Mercury 2.5 (high) vs GLM 5.3 (low)

average score जवळपास समान आहे: 6.5 vs 6.5. Mercury 2.5 (high) चा benchmark खर्च कमी आहे: $0.044 vs $0.473. Mercury 2.5 (high) वेगवान आहे: 7.62s vs 15.28s, pass rates 59.4% vs 63.8%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-01

तुलना केलेली मॉडेल्स

क्रमांक
#194
एकूण आउटपुट टोकन्स
193,676
प्रतिसाद वेळ (सरासरी)
7.62s
एकूण खर्च
$0.044
क्रमांक
#195
एकूण आउटपुट टोकन्स
28,602
प्रतिसाद वेळ (सरासरी)
15.28s
एकूण खर्च
$0.473
शिफारस केलेले मॉडेल Mercury 2.5 (high)

It has the best score here (6.5), while costing about 10.9x less than GLM 5.3 (low).

तपशीलवार तुलना

मेट्रिक Mercury 2.5 Mercury 2.5 high प्रकाशन: 2026-09-08 GLM 5.3 GLM 5.3 low प्रकाशन: 2026-08-20
स्कोअर 6.5 6.5
क्रमांक #194 #195
विश्वसनीयता 9.8 10.0
सुसंगतता 8.7 8.3
प्रयत्न 69/69 69/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 59.4% 63.8%
अस्थिर चाचण्या 4 5
एकूण रन 69 69
प्रति निकाल खर्च 0.362 3.936
एकूण खर्च $0.044 $0.473
इनपुट किंमत $0.040 / 1M $1.400 / 1M
आउटपुट किंमत $0.150 / 1M $4.400 / 1M
एकूण इनपुट टोकन्स 358,562 247,436
आउटपुट टोकन्स 4,266 11,005
रिझनिंग टोकन्स 189,410 17,597
प्रतिसाद वेळ (सरासरी) 7.62s 15.28s
प्रतिसाद वेळ (कमाल) 80.30s 83.60s
प्रतिसाद वेळ (एकूण) 175.36s 351.49s
पॅरामीटर्स ~100B 744B एकूण (40B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#194 Mercury 2.5

high
खर्च
$0.001
वेळ
3.5s
टोकन्स
2,447 tok

#195 GLM 5.3

low
खर्च
$0.007
वेळ
28.4s
टोकन्स
1,599 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Mercury 2.5 6.4 7.8 44.4% 1 6.58s 7,757 415 44,012
GLM 5.3 6.2 6.9 55.6% 1 21.02s 7,317 368 6,764

झटपट तुलना

तुलना जोडी बदला