नेविगेशन
Advertise here

Command A+ vs Mercury 2.5

Mercury 2.5 average score में आगे है: 3.9 vs 3.0. Command A+ की benchmark लागत कम है: $0.000 vs $0.016. Mercury 2.5 तेज है: 2.45s vs 81.36s, pass rates 0.0% vs 25.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-23

तुलना किए गए मॉडल

रैंक
#356
कुल आउटपुट टोकन
0
प्रतिक्रिया समय (औसत)
81.36s
कुल लागत
$0.000
रैंक
#342
कुल आउटपुट टोकन
71,143
प्रतिक्रिया समय (औसत)
2.45s
कुल लागत
$0.016
अनुशंसित मॉडल Mercury 2.5

It has the best score here (3.9), while responding about 33.3x faster than Command A+.

विस्तृत तुलना

मेट्रिक Command A+ Command A+ none रिलीज़: 2026-09-23 Mercury 2.5 Mercury 2.5 none रिलीज़: 2026-09-08
स्कोर 3.0 3.9
रैंक #356 #342
विश्वसनीयता 0.0 10.0
संगति 10.0 7.5
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 0.0% 25.8%
अस्थिर टेस्ट 0 7
कुल रन 66 66
प्रति परिणाम लागत 0.000 0.782
कुल लागत $0.000 $0.016
इनपुट कीमत $0.300 / 1M $0.040 / 1M
आउटपुट कीमत $1.500 / 1M $0.150 / 1M
कुल इनपुट टोकन 0 123,740
आउटपुट टोकन 0 71,143
रीजनिंग टोकन 0 0
प्रतिक्रिया समय (औसत) 81.36s 2.45s
प्रतिक्रिया समय (अधिकतम) 106.37s 36.48s
प्रतिक्रिया समय (कुल) 1789.98s 53.83s
पैरामीटर 218B कुल (25B सक्रिय) ~100B
उपलब्धता मुक्त स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#356 Command A+

none
Provider returned error
लागत
$0.000
समय
0.2s
टोकन
0 tok

#342 Mercury 2.5

none
लागत
$0.001
समय
2.7s
टोकन
2,749 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Command A+ 3.0 10.0 0.0% 0 80.82s 0 0 0
Mercury 2.5 3.7 7.0 22.2% 1 12.50s 7,888 61,297 0

त्वरित तुलना

तुलना जोड़ी बदलें