नेविगेशन
AI BENCHY
Advertise here

Seed-2.0-Mini (medium) vs Mercury 2 (medium)

average score लगभग बराबर है: 7.0 vs 7.0. Mercury 2 (medium) की benchmark लागत कम है: $0.094 vs $0.116. Mercury 2 (medium) तेज है: 2.95s vs 93.10s, pass rates 57.6% vs 53.0%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-03

रैंक
#133
कुल आउटपुट टोकन
258,322
प्रतिक्रिया समय (औसत)
93.10s
कुल लागत
$0.116
रैंक
#131
कुल आउटपुट टोकन
87,554
प्रतिक्रिया समय (औसत)
2.95s
कुल लागत
$0.094
अनुशंसित मॉडल Mercury 2 (medium)

It has the best score here (7.0), while responding about 31.6x faster than Seed-2.0-Mini (medium).

विस्तृत तुलना

मेट्रिक Seed-2.0-Mini Seed-2.0-Mini medium रिलीज़: 2026-02-14 Mercury 2 Mercury 2 medium रिलीज़: 2026-02-24
स्कोर 7.0 7.0
रैंक #133 #131
विश्वसनीयता 8.7 10.0
संगति 8.9 8.4
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 57.6% 53.0%
अस्थिर टेस्ट 3 4
कुल रन 66 66
प्रति परिणाम लागत 1.054 0.933
कुल लागत $0.116 $0.094
इनपुट कीमत $0.100 / 1M $0.250 / 1M
आउटपुट कीमत $0.400 / 1M $0.750 / 1M
कुल इनपुट टोकन 125,704 110,515
आउटपुट टोकन 10,781 10,325
रीजनिंग टोकन 247,541 77,229
प्रतिक्रिया समय (औसत) 93.10s 2.95s
प्रतिक्रिया समय (अधिकतम) 301.78s 14.63s
प्रतिक्रिया समय (कुल) 1768.91s 61.89s
पैरामीटर ~50B कुल (~5B सक्रिय) ~100B
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#133 Seed-2.0-Mini

medium
लागत
$0.002
समय
161.7s
टोकन
4,379 tok

#131 Mercury 2

medium
लागत
$0.002
समय
2.1s
टोकन
1,702 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Mini 5.5 9.8 33.3% 0 220.48s 3,823 464 34,964
Mercury 2 8.2 7.7 77.8% 1 2.04s 7,065 296 11,328

त्वरित तुलना

तुलना जोड़ी बदलें