नेव्हिगेशन
Advertise here

Command A+ (low) vs Mercury 2.5

Mercury 2.5 average score मध्ये पुढे आहे: 3.9 vs 3.0. Command A+ (low) चा benchmark खर्च कमी आहे: $0.000 vs $0.016. Mercury 2.5 वेगवान आहे: 2.45s vs 90.86s, pass rates 0.0% vs 25.8%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-09-23

तुलना केलेली मॉडेल्स

क्रमांक
#354
एकूण आउटपुट टोकन्स
0
प्रतिसाद वेळ (सरासरी)
90.86s
एकूण खर्च
$0.000
क्रमांक
#342
एकूण आउटपुट टोकन्स
71,143
प्रतिसाद वेळ (सरासरी)
2.45s
एकूण खर्च
$0.016
शिफारस केलेले मॉडेल Mercury 2.5

It has the best score here (3.9), while responding about 37.1x faster than Command A+ (low).

तपशीलवार तुलना

मेट्रिक Command A+ Command A+ low प्रकाशन: 2026-09-23 Mercury 2.5 Mercury 2.5 none प्रकाशन: 2026-09-08
स्कोअर 3.0 3.9
क्रमांक #354 #342
विश्वसनीयता 0.0 10.0
सुसंगतता 10.0 7.5
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 0.0% 25.8%
अस्थिर चाचण्या 0 7
एकूण रन 66 66
प्रति निकाल खर्च 0.000 0.782
एकूण खर्च $0.000 $0.016
इनपुट किंमत $0.300 / 1M $0.040 / 1M
आउटपुट किंमत $1.500 / 1M $0.150 / 1M
एकूण इनपुट टोकन्स 0 123,740
आउटपुट टोकन्स 0 71,143
रिझनिंग टोकन्स 0 0
प्रतिसाद वेळ (सरासरी) 90.86s 2.45s
प्रतिसाद वेळ (कमाल) 116.28s 36.48s
प्रतिसाद वेळ (एकूण) 1998.86s 53.83s
पॅरामीटर्स 218B एकूण (25B सक्रिय) ~100B
उपलब्धता मुक्त स्रोत बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#354 Command A+

low
Provider returned error
खर्च
$0.000
वेळ
0.2s
टोकन्स
0 tok

#342 Mercury 2.5

none
खर्च
$0.001
वेळ
2.7s
टोकन्स
2,749 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Command A+ 3.0 10.0 0.0% 0 86.43s 0 0 0
Mercury 2.5 3.7 7.0 22.2% 1 12.50s 7,888 61,297 0

झटपट तुलना

तुलना जोडी बदला