नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Qwen3.7 Max vs MiMo-V2.5 (medium)

Qwen3.7 Max average score में आगे है: 7.4 vs 6.4. MiMo-V2.5 (medium) की benchmark लागत कम है: $0.104 vs $0.197. Qwen3.7 Max तेज है: 4.56s vs 46.28s, pass rates 68.2% vs 68.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-20

रैंक
#91
कुल आउटपुट टोकन
12,446
प्रतिक्रिया समय (औसत)
4.56s
कुल लागत
$0.197
रैंक
#160
कुल आउटपुट टोकन
327,048
प्रतिक्रिया समय (औसत)
46.28s
कुल लागत
$0.104
अनुशंसित मॉडल Qwen3.7 Max

It has the best score here (7.4), while responding about 10.2x faster than MiMo-V2.5 (medium).

विस्तृत तुलना

मेट्रिक Qwen3.7 Max Qwen3.7 Max none रिलीज़: 2026-05-22 MiMo-V2.5 MiMo-V2.5 medium रिलीज़: 2026-04-22
स्कोर 7.4 6.4
रैंक #91 #160
विश्वसनीयता 9.9 10.0
संगति 10.0 7.5
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 68.2% 68.2%
अस्थिर टेस्ट 0 7
कुल रन 66 66
प्रति परिणाम लागत 1.581 3.575
कुल लागत $0.197 $0.104
इनपुट कीमत $1.475 / 1M $0.140 / 1M
आउटपुट कीमत $4.425 / 1M $0.280 / 1M
कुल इनपुट टोकन 95,992 105,456
आउटपुट टोकन 12,446 7,108
रीजनिंग टोकन 0 319,940
प्रतिक्रिया समय (औसत) 4.56s 46.28s
प्रतिक्रिया समय (अधिकतम) 72.30s 316.27s
प्रतिक्रिया समय (कुल) 100.30s 1018.12s
पैरामीटर ~1T कुल (~40B सक्रिय) 310B कुल (15B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#91 Qwen3.7 Max

none
लागत
$0.046
समय
195.0s
टोकन
12,171 tok

#160 MiMo-V2.5

medium
लागत
$0.002
समय
54.8s
टोकन
5,247 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.7 Max 5.5 10.0 33.3% 0 1.35s 7,911 582 0
MiMo-V2.5 6.2 4.7 66.7% 2 97.14s 7,422 557 81,977

त्वरित तुलना

तुलना जोड़ी बदलें