नेव्हिगेशन
AI BENCHY
Advertise here

AI BENCHY Compare

Inception: Mercury 2 vs Xiaomi: MiMo-V2.5-Pro

सारांश

Mercury 2 vs MiMo-V2.5-Pro benchmark तुलना: MiMo-V2.5-Pro average score मध्ये पुढे आहे: 5.5 vs 4.6. Mercury 2 चा benchmark खर्च कमी आहे: $0.011 vs $0.017. Mercury 2 वेगवान आहे: 653ms vs 1.78s, pass rates 23.8% vs 39.7%.

शिफारस केलेले मॉडेल: Mercury 2 - It offers the best overall trade-off: a competitive score (4.6), lower cost than MiMo-V2.5-Pro, and balanced response time.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-06-18

मेट्रिक Mercury 2 Mercury 2 none प्रकाशन: 2026-02-24 MiMo-V2.5-Pro MiMo-V2.5-Pro none प्रकाशन: 2026-04-22
स्कोअर 4.6 5.5
क्रमांक #151 #119
विश्वसनीयता 10.0 10.0
सुसंगतता 9.2 8.6
बरोबर चाचण्या
प्रति प्रयत्न पास दर 23.8% 39.7%
अस्थिर चाचण्या 2 4
एकूण रन 63 63
प्रति निकाल खर्च 0.259 0.648
एकूण खर्च $0.011 $0.017
इनपुट किंमत $0.250 / 1M $0.435 / 1M
आउटपुट किंमत $0.750 / 1M $0.870 / 1M
एकूण इनपुट टोकन्स 28,113 30,724
आउटपुट टोकन्स 4,439 3,043
रिझनिंग टोकन्स 0 0
प्रतिसाद वेळ (सरासरी) 653ms 1.78s
प्रतिसाद वेळ (कमाल) 1.43s 8.32s
प्रतिसाद वेळ (एकूण) 13.72s 37.42s

जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#151 Mercury 2

none
खर्च
$0.002
वेळ
1.8s
टोकन्स
1,514 tok

#119 MiMo-V2.5-Pro

none
खर्च
$0.004
वेळ
46.4s
टोकन्स
4,025 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Mercury 2 3.0 10.0 0.0% 0 483ms 631 286 0
MiMo-V2.5-Pro 3.3 8.1 8.3% 1 2.67s 645 994 0
कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Mercury 2 3.4 9.6 0.0% 0 1.03s 7,229 3,088 0
MiMo-V2.5-Pro 4.3 7.8 22.2% 1 1.41s 6,559 485 0
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Mercury 2 3.0 10.0 0.0% 0 606ms 4,821 131 0
MiMo-V2.5-Pro 3.0 10.0 0.0% 0 3.54s 4,695 596 0
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Mercury 2 7.3 5.9 83.3% 1 667ms 6,362 180 0
MiMo-V2.5-Pro 10.0 10.0 100.0% 0 1.32s 7,758 249 0
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Mercury 2 5.3 7.2 44.4% 1 534ms 784 46 0
MiMo-V2.5-Pro 5.3 10.0 33.3% 0 877ms 753 27 0
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Mercury 2 4.8 10.0 0.0% 0 628ms 495 159 0
MiMo-V2.5-Pro 4.0 10.0 0.0% 0 2.58s 498 87 0
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Mercury 2 6.5 10.0 50.0% 0 551ms 691 82 0
MiMo-V2.5-Pro 6.4 10.0 50.0% 0 1.03s 684 66 0
कोडी सोडवणे स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Mercury 2 3.1 10.0 0.0% 0 535ms 694 251 0
MiMo-V2.5-Pro 6.7 4.7 77.8% 2 1.30s 678 267 0
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Mercury 2 10.0 10.0 100.0% 0 1.27s 6,193 197 0
MiMo-V2.5-Pro 10.0 10.0 100.0% 0 3.30s 8,238 258 0
सामान्य ज्ञान स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Mercury 2 3.0 10.0 0.0% 0 548ms 213 19 0
MiMo-V2.5-Pro 3.0 10.0 0.0% 0 1.89s 216 14 0

झटपट तुलना

तुलना जोडी बदला