नेविगेशन
AI BENCHY
Advertise here

Qwen3.6 Max Preview vs MiMo-V2.5 (medium)

average score लगभग बराबर है: 6.4 vs 6.4. MiMo-V2.5 (medium) की benchmark लागत कम है: $0.104 vs $0.228. Qwen3.6 Max Preview तेज है: 7.82s vs 46.28s, pass rates 56.1% vs 68.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-15

रैंक
#154
कुल आउटपुट टोकन
19,257
प्रतिक्रिया समय (औसत)
7.82s
कुल लागत
$0.228
रैंक
#158
कुल आउटपुट टोकन
327,048
प्रतिक्रिया समय (औसत)
46.28s
कुल लागत
$0.104
अनुशंसित मॉडल Qwen3.6 Max Preview

It has the best score here (6.4), while responding about 5.9x faster than MiMo-V2.5 (medium).

विस्तृत तुलना

मेट्रिक Qwen3.6 Max Preview Qwen3.6 Max Preview none रिलीज़: 2026-04-20 MiMo-V2.5 MiMo-V2.5 medium रिलीज़: 2026-04-22
स्कोर 6.4 6.4
रैंक #154 #158
विश्वसनीयता 9.9 10.0
संगति 9.3 7.5
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 56.1% 68.2%
अस्थिर टेस्ट 2 7
कुल रन 66 66
प्रति परिणाम लागत 2.248 3.575
कुल लागत $0.228 $0.104
इनपुट कीमत $1.028 / 1M $0.140 / 1M
आउटपुट कीमत $6.162 / 1M $0.280 / 1M
कुल इनपुट टोकन 106,348 105,456
आउटपुट टोकन 19,257 7,108
रीजनिंग टोकन 0 319,940
प्रतिक्रिया समय (औसत) 7.82s 46.28s
प्रतिक्रिया समय (अधिकतम) 102.62s 316.27s
प्रतिक्रिया समय (कुल) 172.04s 1018.12s
पैरामीटर ~1T कुल (~40B सक्रिय) 310B कुल (15B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#154 Qwen3.6 Max Preview

none
लागत
$0.025
समय
83.9s
टोकन
4,066 tok

#158 MiMo-V2.5

medium
लागत
$0.002
समय
54.8s
टोकन
5,247 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.6 Max Preview 3.8 7.3 22.2% 1 3.12s 7,913 456 0
MiMo-V2.5 6.2 4.7 66.7% 2 97.14s 7,422 557 81,977

त्वरित तुलना

तुलना जोड़ी बदलें