नेविगेशन
Advertise here

Command A+ (high) vs Mercury 2.5

Mercury 2.5 average score में आगे है: 3.9 vs 3.0. Command A+ (high) की benchmark लागत कम है: $0.000 vs $0.016. Mercury 2.5 तेज है: 2.45s vs 86.95s, pass rates 0.0% vs 25.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-23

तुलना किए गए मॉडल

रैंक
#353
कुल आउटपुट टोकन
0
प्रतिक्रिया समय (औसत)
86.95s
कुल लागत
$0.000
रैंक
#342
कुल आउटपुट टोकन
71,143
प्रतिक्रिया समय (औसत)
2.45s
कुल लागत
$0.016
अनुशंसित मॉडल Mercury 2.5

It has the best score here (3.9), while responding about 35.5x faster than Command A+ (high).

विस्तृत तुलना

मेट्रिक Command A+ Command A+ high रिलीज़: 2026-09-23 Mercury 2.5 Mercury 2.5 none रिलीज़: 2026-09-08
स्कोर 3.0 3.9
रैंक #353 #342
विश्वसनीयता 0.0 10.0
संगति 10.0 7.5
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 0.0% 25.8%
अस्थिर टेस्ट 0 7
कुल रन 66 66
प्रति परिणाम लागत 0.000 0.782
कुल लागत $0.000 $0.016
इनपुट कीमत $0.300 / 1M $0.040 / 1M
आउटपुट कीमत $1.500 / 1M $0.150 / 1M
कुल इनपुट टोकन 0 123,740
आउटपुट टोकन 0 71,143
रीजनिंग टोकन 0 0
प्रतिक्रिया समय (औसत) 86.95s 2.45s
प्रतिक्रिया समय (अधिकतम) 114.87s 36.48s
प्रतिक्रिया समय (कुल) 1913.01s 53.83s
पैरामीटर 218B कुल (25B सक्रिय) ~100B
उपलब्धता मुक्त स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#353 Command A+

high
Provider returned error
लागत
$0.000
समय
0.2s
टोकन
0 tok

#342 Mercury 2.5

none
लागत
$0.001
समय
2.7s
टोकन
2,749 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Command A+ 3.0 10.0 0.0% 0 92.74s 0 0 0
Mercury 2.5 3.7 7.0 22.2% 1 12.50s 7,888 61,297 0

त्वरित तुलना

तुलना जोड़ी बदलें