नेविगेशन
Advertise here

Mercury 2.5 (low) vs MiMo-V2.5-Pro

average score लगभग बराबर है: 5.1 vs 5.1. Mercury 2.5 (low) की benchmark लागत कम है: $0.020 vs $0.157. Mercury 2.5 (low) तेज है: 3.34s vs 6.21s, pass rates 37.7% vs 31.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#293
कुल आउटपुट टोकन
40,302
प्रतिक्रिया समय (औसत)
3.34s
कुल लागत
$0.020
रैंक
#295
कुल आउटपुट टोकन
17,069
प्रतिक्रिया समय (औसत)
6.21s
कुल लागत
$0.157
अनुशंसित मॉडल Mercury 2.5 (low)

It has the best score here (5.1), while costing about 8.2x less than MiMo-V2.5-Pro.

विस्तृत तुलना

मेट्रिक Mercury 2.5 Mercury 2.5 low रिलीज़: 2026-09-08 MiMo-V2.5-Pro MiMo-V2.5-Pro none रिलीज़: 2026-04-22
स्कोर 5.1 5.1
रैंक #293 #295
विश्वसनीयता 9.8 10.0
संगति 8.2 8.7
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 37.7% 31.9%
अस्थिर टेस्ट 5 4
कुल रन 69 69
प्रति परिणाम लागत 0.319 3.128
कुल लागत $0.020 $0.157
इनपुट कीमत $0.040 / 1M $0.435 / 1M
आउटपुट कीमत $0.150 / 1M $0.870 / 1M
कुल इनपुट टोकन 326,083 273,075
आउटपुट टोकन 7,224 17,069
रीजनिंग टोकन 33,078 0
प्रतिक्रिया समय (औसत) 3.34s 6.21s
प्रतिक्रिया समय (अधिकतम) 47.06s 53.13s
प्रतिक्रिया समय (कुल) 76.80s 142.89s
पैरामीटर ~100B 1.02T कुल (42B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#293 Mercury 2.5

low
लागत
$0.001
समय
2.4s
टोकन
1,236 tok

#295 MiMo-V2.5-Pro

none
लागत
$0.004
समय
46.4s
टोकन
4,025 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Mercury 2.5 5.5 10.0 33.3% 0 972ms 7,909 521 2,269
MiMo-V2.5-Pro 4.3 7.8 22.2% 1 1.41s 6,559 485 0

त्वरित तुलना

तुलना जोड़ी बदलें