नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

OpenAI: GPT-5.6 Luna vs Xiaomi: MiMo-V2.5-Pro

MiMo-V2.5-Pro average score में आगे है: 5.5 vs 5.4. MiMo-V2.5-Pro की benchmark लागत कम है: $0.068 vs $0.142. GPT-5.6 Luna तेज है: 1.50s vs 4.12s, pass rates 34.9% vs 37.9%.

अनुशंसित मॉडलMiMo-V2.5-ProIt has the best score here (5.5), while costing about 2.1x less than GPT-5.6 Luna.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-22

मेट्रिक GPT-5.6 Luna GPT-5.6 Luna none रिलीज़: 2026-07-09 MiMo-V2.5-Pro MiMo-V2.5-Pro none रिलीज़: 2026-04-22
स्कोर 5.4 5.5
रैंक #166 #160
विश्वसनीयता 10.0 10.0
संगति 8.8 8.6
सही परीक्षण
प्रति प्रयास पास दर 34.9% 37.9%
अस्थिर टेस्ट 3 4
कुल रन 66 66
प्रति परिणाम लागत 2.360 1.509
कुल लागत $0.142 $0.068
इनपुट कीमत $1.000 / 1M $0.435 / 1M
आउटपुट कीमत $6.000 / 1M $0.870 / 1M
कुल इनपुट टोकन 101,323 124,799
आउटपुट टोकन 6,709 15,362
रीजनिंग टोकन 0 0
प्रतिक्रिया समय (औसत) 1.50s 4.12s
प्रतिक्रिया समय (अधिकतम) 10.57s 53.13s
प्रतिक्रिया समय (कुल) 32.91s 90.55s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#166 GPT-5.6 Luna

none
लागत
$0.016
समय
15.8s
टोकन
2,685 tok

#160 MiMo-V2.5-Pro

none
लागत
$0.004
समय
46.4s
टोकन
4,025 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.6 Luna 3.8 7.2 22.2% 1 980ms 7,302 459 0
MiMo-V2.5-Pro 4.3 7.8 22.2% 1 1.41s 6,559 485 0

त्वरित तुलना

तुलना जोड़ी बदलें