नेव्हिगेशन
Advertise here

Command A+ (high) vs Mercury 2.5

Mercury 2.5 average score मध्ये पुढे आहे: 3.9 vs 3.0. Command A+ (high) चा benchmark खर्च कमी आहे: $0.000 vs $0.016. Mercury 2.5 वेगवान आहे: 2.45s vs 86.95s, pass rates 0.0% vs 25.8%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-09-23

तुलना केलेली मॉडेल्स

क्रमांक
#353
एकूण आउटपुट टोकन्स
0
प्रतिसाद वेळ (सरासरी)
86.95s
एकूण खर्च
$0.000
क्रमांक
#342
एकूण आउटपुट टोकन्स
71,143
प्रतिसाद वेळ (सरासरी)
2.45s
एकूण खर्च
$0.016
शिफारस केलेले मॉडेल Mercury 2.5

It has the best score here (3.9), while responding about 35.5x faster than Command A+ (high).

तपशीलवार तुलना

मेट्रिक Command A+ Command A+ high प्रकाशन: 2026-09-23 Mercury 2.5 Mercury 2.5 none प्रकाशन: 2026-09-08
स्कोअर 3.0 3.9
क्रमांक #353 #342
विश्वसनीयता 0.0 10.0
सुसंगतता 10.0 7.5
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 0.0% 25.8%
अस्थिर चाचण्या 0 7
एकूण रन 66 66
प्रति निकाल खर्च 0.000 0.782
एकूण खर्च $0.000 $0.016
इनपुट किंमत $0.300 / 1M $0.040 / 1M
आउटपुट किंमत $1.500 / 1M $0.150 / 1M
एकूण इनपुट टोकन्स 0 123,740
आउटपुट टोकन्स 0 71,143
रिझनिंग टोकन्स 0 0
प्रतिसाद वेळ (सरासरी) 86.95s 2.45s
प्रतिसाद वेळ (कमाल) 114.87s 36.48s
प्रतिसाद वेळ (एकूण) 1913.01s 53.83s
पॅरामीटर्स 218B एकूण (25B सक्रिय) ~100B
उपलब्धता मुक्त स्रोत बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#353 Command A+

high
Provider returned error
खर्च
$0.000
वेळ
0.2s
टोकन्स
0 tok

#342 Mercury 2.5

none
खर्च
$0.001
वेळ
2.7s
टोकन्स
2,749 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Command A+ 3.0 10.0 0.0% 0 92.74s 0 0 0
Mercury 2.5 3.7 7.0 22.2% 1 12.50s 7,888 61,297 0

झटपट तुलना

तुलना जोडी बदला