नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

OpenAI: GPT-5.5 vs Xiaomi: MiMo-V2.5

GPT-5.5 (low) average score में आगे है: 9.3 vs 6.5. MiMo-V2.5 (medium) की benchmark लागत कम है: $0.082 vs $1.253. GPT-5.5 (low) तेज है: 10.13s vs 32.20s, pass rates 86.4% vs 69.7%.

अनुशंसित मॉडलGPT-5.5 (low)It has the best score here (9.3), while responding about 3.2x faster than MiMo-V2.5 (medium).

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-21

मेट्रिक GPT-5.5 GPT-5.5 low रिलीज़: 2026-04-24 MiMo-V2.5 MiMo-V2.5 medium रिलीज़: 2026-04-22
स्कोर 9.3 6.5
रैंक #9 #107
विश्वसनीयता 10.0 10.0
संगति 10.0 7.9
सही परीक्षण
प्रति प्रयास पास दर 86.4% 69.7%
अस्थिर टेस्ट 0 6
कुल रन 66 66
प्रति परिणाम लागत 6.594 3.124
कुल लागत $1.253 $0.082
इनपुट कीमत $5.000 / 1M $0.140 / 1M
आउटपुट कीमत $30.000 / 1M $0.280 / 1M
कुल इनपुट टोकन 80,058 105,447
आउटपुट टोकन 5,378 7,120
रीजनिंग टोकन 23,040 230,682
प्रतिक्रिया समय (औसत) 10.13s 32.20s
प्रतिक्रिया समय (अधिकतम) 56.19s 162.44s
प्रतिक्रिया समय (कुल) 222.82s 708.46s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#9 GPT-5.5

low
लागत
$0.068
समय
37.0s
टोकन
2,339 tok

#107 MiMo-V2.5

medium
लागत
$0.002
समय
54.8s
टोकन
5,247 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.5 10.0 10.0 100.0% 0 15.04s 7,302 423 6,402
MiMo-V2.5 6.2 4.7 66.7% 2 97.14s 7,422 557 81,977

त्वरित तुलना

तुलना जोड़ी बदलें