नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY तुलना

OpenAI: GPT-4o-mini vs Xiaomi: MiMo-V2.5-Pro

सारांश

GPT-4o-mini vs MiMo-V2.5-Pro benchmark तुलना: MiMo-V2.5-Pro average score में आगे है: 5.5 vs 5.0. GPT-4o-mini की benchmark लागत कम है: $0.006 vs $0.017. GPT-4o-mini तेज है: 1.77s vs 1.78s, pass rates 23.8% vs 39.7%.

अनुशंसित मॉडल: MiMo-V2.5-Pro - It has the strongest score in this comparison (5.5) and the best overall balance of cost and response time across all 2 models.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-02

मेट्रिक GPT-4o-mini GPT-4o-mini none रिलीज़: 2024-07-18 MiMo-V2.5-Pro MiMo-V2.5-Pro none रिलीज़: 2026-04-22
स्कोर 5.0 5.5
रैंक #144 #123
विश्वसनीयता 10.0 10.0
संगति 9.9 8.6
सही परीक्षण
प्रति प्रयास पास दर 23.8% 39.7%
अस्थिर टेस्ट 0 4
कुल रन 63 63
प्रति परिणाम लागत 0.119 0.648
कुल लागत $0.006 $0.017
इनपुट कीमत $0.150 / 1M $0.435 / 1M
आउटपुट कीमत $0.600 / 1M $0.870 / 1M
कुल इनपुट टोकन 31,518 30,724
आउटपुट टोकन 1,982 3,043
रीजनिंग टोकन 0 0
प्रतिक्रिया समय (औसत) 1.77s 1.78s
प्रतिक्रिया समय (अधिकतम) 7.58s 8.32s
प्रतिक्रिया समय (कुल) 24.80s 37.42s

जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#144 GPT-4o-mini

none
लागत
$0.001
समय
6.6s
टोकन
742 tok

#123 MiMo-V2.5-Pro

none
लागत
$0.004
समय
46.4s
टोकन
4,025 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-4o-mini 4.8 10.0 25.0% 0 1.34s 618 186 0
MiMo-V2.5-Pro 3.3 8.1 8.3% 1 2.67s 645 994 0
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-4o-mini 3.2 9.6 0.0% 0 1.63s 7,314 367 0
MiMo-V2.5-Pro 4.3 7.8 22.2% 1 1.41s 6,559 485 0
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-4o-mini 3.0 10.0 0.0% 0 7.58s 8,298 568 0
MiMo-V2.5-Pro 3.0 10.0 0.0% 0 3.54s 4,695 596 0
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-4o-mini 10.0 10.0 100.0% 0 1.27s 7,161 183 0
MiMo-V2.5-Pro 10.0 10.0 100.0% 0 1.32s 7,758 249 0
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-4o-mini 3.0 10.0 0.0% 0 637ms 732 15 0
MiMo-V2.5-Pro 5.3 10.0 33.3% 0 877ms 753 27 0
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-4o-mini 4.0 10.0 0.0% 0 909ms 480 66 0
MiMo-V2.5-Pro 4.0 10.0 0.0% 0 2.58s 498 87 0
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-4o-mini 6.3 10.0 50.0% 0 1.11s 666 69 0
MiMo-V2.5-Pro 6.4 10.0 50.0% 0 1.03s 684 66 0
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-4o-mini 3.5 10.0 0.0% 0 1.21s 651 308 0
MiMo-V2.5-Pro 6.7 4.7 77.8% 2 1.30s 678 267 0
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-4o-mini 10.0 10.0 100.0% 0 2.51s 5,400 205 0
MiMo-V2.5-Pro 10.0 10.0 100.0% 0 3.30s 8,238 258 0
सामान्य ज्ञान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-4o-mini 3.0 10.0 0.0% 0 794ms 198 15 0
MiMo-V2.5-Pro 3.0 10.0 0.0% 0 1.89s 216 14 0

त्वरित तुलना

तुलना जोड़ी बदलें