नेविगेशन
AI BENCHY
Advertise here

Qwen: Qwen3 Coder Next vs Xiaomi: MiMo-V2.5

MiMo-V2.5 average score में आगे है: 5.1 vs 4.7. MiMo-V2.5 की benchmark लागत कम है: $0.025 vs $0.032. MiMo-V2.5 तेज है: 4.62s vs 9.61s, pass rates 27.3% vs 25.8%.

अनुशंसित मॉडलMiMo-V2.5It has the best score here (5.1), while responding about 2.1x faster than Qwen3 Coder Next (medium).

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-21

मेट्रिक Qwen3 Coder Next Qwen3 Coder Next medium रिलीज़: 2026-02-03 MiMo-V2.5 MiMo-V2.5 none रिलीज़: 2026-04-22
स्कोर 4.7 5.1
रैंक #193 #174
विश्वसनीयता 10.0 10.0
संगति 9.0 9.6
सही परीक्षण
प्रति प्रयास पास दर 27.3% 25.8%
अस्थिर टेस्ट 3 1
कुल रन 66 66
प्रति परिणाम लागत 0.793 0.770
कुल लागत $0.032 $0.025
इनपुट कीमत $0.110 / 1M $0.140 / 1M
आउटपुट कीमत $0.800 / 1M $0.280 / 1M
कुल इनपुट टोकन 148,194 141,043
आउटपुट टोकन 19,069 16,464
रीजनिंग टोकन 0 0
प्रतिक्रिया समय (औसत) 9.61s 4.62s
प्रतिक्रिया समय (अधिकतम) 81.80s 55.36s
प्रतिक्रिया समय (कुल) 153.69s 101.57s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#193 Qwen3 Coder Next

medium
अमान्य SVG
लागत
$0.000
समय
300.0s
टोकन
0 tok

#174 MiMo-V2.5

none
लागत
$0.007
समय
267.4s
टोकन
25,283 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3 Coder Next 3.7 7.2 22.2% 1 924ms 7,185 336 0
MiMo-V2.5 5.5 10.0 33.3% 0 3.24s 7,440 696 0

त्वरित तुलना

तुलना जोड़ी बदलें