नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY तुलना

OpenAI: GPT-5.3-Codex vs Xiaomi: MiMo-V2.5-Pro

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-05-08

मेट्रिक GPT-5.3-Codex GPT-5.3-Codex medium रिलीज़: 2026-02-05 MiMo-V2.5-Pro MiMo-V2.5-Pro medium रिलीज़: 2026-04-22
स्कोर 8.2 8.1
रैंक #13 #18
विश्वसनीयता 10.0 10.0
संगति 8.3 9.2
सही परीक्षण
प्रति प्रयास पास दर 80.7% 74.1%
अस्थिर टेस्ट 4 2
कुल रन 57 54
प्रति परिणाम लागत 4.594 1.661
कुल लागत $0.598 $0.200
???? ??? $1.750 / 1M $1.000 / 1M
????? ??? $14.000 / 1M $3.000 / 1M
आउटपुट टोकन 2,309 2,790
रीजनिंग टोकन 36,880 52,001
प्रतिक्रिया समय (औसत) 15.33s 16.23s
प्रतिक्रिया समय (अधिकतम) 100.93s 84.22s
प्रतिक्रिया समय (कुल) 291.34s 292.10s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.3-Codex 8.7 7.9 91.7% 1 4.16s 240 1,722
MiMo-V2.5-Pro 10.0 10.0 100.0% 0 3.26s 323 1,179
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.3-Codex 10.0 10.0 100.0% 0 8.95s 491 1,530
MiMo-V2.5-Pro 10.0 10.0 100.0% 0 32.58s 543 7,485
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.3-Codex 10.0 10.0 100.0% 0 19.56s 364 2,731
MiMo-V2.5-Pro 10.0 10.0 100.0% 0 53.36s 348 11,870
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.3-Codex 10.0 10.0 100.0% 0 3.07s 234 728
MiMo-V2.5-Pro 7.3 5.8 83.3% 1 18.81s 260 8,383
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.3-Codex 5.9 7.2 55.6% 1 64.31s 64 25,308
MiMo-V2.5-Pro 5.3 10.0 33.3% 0 37.87s 275 17,023
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.3-Codex 4.6 10.0 0.0% 0 4.87s 187 331
MiMo-V2.5-Pro 5.5 10.0 0.0% 0 4.02s 155 163
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.3-Codex 10.0 10.0 100.0% 0 3.04s 93 693
MiMo-V2.5-Pro 9.9 10.0 100.0% 0 2.77s 82 803
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.3-Codex 9.0 7.9 88.9% 1 5.12s 352 1,644
MiMo-V2.5-Pro 6.7 7.9 55.6% 1 5.16s 493 2,187
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.3-Codex 10.0 10.0 100.0% 0 6.37s 254 492
MiMo-V2.5-Pro 10.0 10.0 100.0% 0 16.87s 311 2,908
सामान्य ज्ञान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.3-Codex 2.8 1.6 33.3% 1 14.43s 30 1,701
MiMo-V2.5-Pro - - - - - - - -

त्वरित तुलना

तुलना जोड़ी बदलें