नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Anthropic: Claude Opus 4.8 vs Xiaomi: MiMo-V2.5-Pro

सारांश

Claude Opus 4.8 vs MiMo-V2.5-Pro benchmark तुलना: MiMo-V2.5-Pro average score मध्ये पुढे आहे: 7.5 vs 7.0. MiMo-V2.5-Pro चा benchmark खर्च कमी आहे: $0.106 vs $0.539. Claude Opus 4.8 वेगवान आहे: 3.47s vs 26.13s, pass rates 61.9% vs 68.3%.

शिफारस केलेले मॉडेल: MiMo-V2.5-Pro - It has the best score here (7.5), while costing about 5.1x less than Claude Opus 4.8.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-06-04

मेट्रिक Claude Opus 4.8 Claude Opus 4.8 none प्रकाशन: 2026-05-28 MiMo-V2.5-Pro MiMo-V2.5-Pro medium प्रकाशन: 2026-04-22
स्कोअर 7.0 7.5
क्रमांक #68 #43
विश्वसनीयता 10.0 10.0
सुसंगतता 9.2 8.5
बरोबर चाचण्या
प्रति प्रयत्न पास दर 61.9% 68.3%
अस्थिर चाचण्या 2 4
एकूण रन 63 63
प्रति निकाल खर्च 4.485 2.541
एकूण खर्च $0.539 $0.106
इनपुट किंमत $5.000 / 1M $0.435 / 1M
आउटपुट किंमत $25.000 / 1M $0.870 / 1M
एकूण इनपुट टोकन्स 67,104 40,854
आउटपुट टोकन्स 8,107 5,015
रिझनिंग टोकन्स 0 97,742
प्रतिसाद वेळ (सरासरी) 3.47s 26.13s
प्रतिसाद वेळ (कमाल) 17.73s 130.77s
प्रतिसाद वेळ (एकूण) 72.90s 548.65s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#68 Claude Opus 4.8

none
Cost
$0.053
Time
22.0s
Tokens
2,253 tok

#43 MiMo-V2.5-Pro

medium
Invalid SVG
Cost
$0.000
Time
300.0s
Tokens
0 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.8 6.5 10.0 50.0% 0 3.40s 834 1,472 0
MiMo-V2.5-Pro 10.0 10.0 100.0% 0 3.26s 621 323 1,179
कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.8 5.5 10.0 33.3% 0 3.29s 10,590 1,332 0
MiMo-V2.5-Pro 6.2 4.7 66.7% 2 92.07s 6,543 780 51,218
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.8 9.5 10.0 100.0% 0 17.73s 29,658 3,259 0
MiMo-V2.5-Pro 10.0 10.0 100.0% 0 53.36s 15,060 348 11,870
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.8 7.3 5.8 83.3% 1 1.77s 10,503 308 0
MiMo-V2.5-Pro 7.3 5.8 83.3% 1 18.81s 7,746 260 8,383
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.8 5.3 7.2 44.4% 1 1.66s 975 61 0
MiMo-V2.5-Pro 5.3 10.0 33.3% 0 37.87s 630 275 17,023
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.8 10.0 10.0 100.0% 0 3.48s 708 230 0
MiMo-V2.5-Pro 5.5 10.0 0.0% 0 4.02s 492 155 163
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.8 9.9 10.0 100.0% 0 1.37s 909 95 0
MiMo-V2.5-Pro 9.9 10.0 100.0% 0 2.77s 672 82 803
कोडी सोडवणे स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.8 7.7 10.0 66.7% 0 2.74s 894 783 0
MiMo-V2.5-Pro 6.7 7.9 55.6% 1 5.31s 660 540 2,181
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.8 10.0 10.0 100.0% 0 5.35s 11,775 355 0
MiMo-V2.5-Pro 10.0 10.0 100.0% 0 16.87s 8,220 311 2,908
सामान्य ज्ञान स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.8 3.0 10.0 0.0% 0 3.41s 258 212 0
MiMo-V2.5-Pro 3.0 10.0 0.0% 0 12.46s 210 1,941 2,014

झटपट तुलना

तुलना जोडी बदला