नेविगेशन
AI BENCHY
Advertise here

Cobuddy (medium) vs Mercury 2

average score लगभग बराबर है: 4.7 vs 4.7. Cobuddy (medium) की benchmark लागत कम है: $0.000 vs $0.030. Mercury 2 तेज है: 825ms vs 39.90s, pass rates 45.5% vs 24.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-03

रैंक
#280
कुल आउटपुट टोकन
118,380
प्रतिक्रिया समय (औसत)
39.90s
कुल लागत
$0.000
रैंक
#281
कुल आउटपुट टोकन
9,584
प्रतिक्रिया समय (औसत)
825ms
कुल लागत
$0.030
अनुशंसित मॉडल Mercury 2

It has the best score here (4.7), while responding about 48.4x faster than Cobuddy (medium).

विस्तृत तुलना

मेट्रिक Cobuddy Cobuddy medium रिलीज़: 2026-05-06 Mercury 2 Mercury 2 none रिलीज़: 2026-02-24
स्कोर 4.7 4.7
रैंक #280 #281
विश्वसनीयता 10.0 10.0
संगति 7.2 9.2
प्रयास 63/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 45.5% 24.2%
अस्थिर टेस्ट 6 2
कुल रन 63 66
प्रति परिणाम लागत 0.000 0.740
कुल लागत $0.000 $0.030
इनपुट कीमत $0.000 / 1M $0.250 / 1M
आउटपुट कीमत $0.000 / 1M $0.750 / 1M
कुल इनपुट टोकन 37,449 89,637
आउटपुट टोकन 1,677 9,584
रीजनिंग टोकन 116,703 0
प्रतिक्रिया समय (औसत) 39.90s 825ms
प्रतिक्रिया समय (अधिकतम) 309.02s 4.52s
प्रतिक्रिया समय (कुल) 797.98s 18.14s
पैरामीटर ~21B कुल (~3B सक्रिय) ~100B
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#280 Cobuddy

medium
No endpoints found for baidu/cobuddy:free.
लागत
$0.000
समय
0.1s
टोकन
0 tok

#281 Mercury 2

none
लागत
$0.002
समय
1.8s
टोकन
1,514 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Cobuddy 3.7 6.7 22.2% 1 79.17s 4,726 358 30,138
Mercury 2 3.4 9.6 0.0% 0 1.03s 7,229 3,088 0

त्वरित तुलना

तुलना जोड़ी बदलें

Granite 4.2 8BhighvsMercury 2noneCobuddymediumvsGranite 4.2 8BhighTrinity Large PreviewnonevsCobuddymediumCobuddymediumvsGLM 4.7 FlashnoneMercury 2nonevsQwen3 Coder NextmediumCobuddymediumvsKAT-Coder-Air V2.5noneMercury 2nonevsMiniMax M2.5mediumTrinity Large ThinkinghighvsCobuddymediumCobuddymediumvsGPT-5.4 NanononeTrinity Large ThinkinghighvsMercury 2noneCobuddymediumvsNemotron 3.5 Lightninglowनिःशुल्क उपलब्धCobuddymediumvsLaguna S 2.1noneनिःशुल्क उपलब्ध