नेविगेशन
AI BENCHY
Advertise here

Qwen: Qwen3.6 27B vs Xiaomi: MiMo-V2.5

average score लगभग बराबर है: 6.5 vs 6.5. MiMo-V2.5 (medium) की benchmark लागत कम है: $0.082 vs $0.779. MiMo-V2.5 (medium) तेज है: 32.20s vs 106.32s, pass rates 59.1% vs 69.7%.

अनुशंसित मॉडलMiMo-V2.5 (medium)It has the best score here (6.5), while costing about 9.6x less than Qwen3.6 27B (medium).

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-21

मेट्रिक Qwen3.6 27B Qwen3.6 27B medium रिलीज़: 2026-04-20 MiMo-V2.5 MiMo-V2.5 medium रिलीज़: 2026-04-22
स्कोर 6.5 6.5
रैंक #105 #107
विश्वसनीयता 10.0 10.0
संगति 8.0 7.9
सही परीक्षण
प्रति प्रयास पास दर 59.1% 69.7%
अस्थिर टेस्ट 6 6
कुल रन 66 66
प्रति परिणाम लागत 7.319 3.124
कुल लागत $0.779 $0.082
इनपुट कीमत $0.450 / 1M $0.140 / 1M
आउटपुट कीमत $2.700 / 1M $0.280 / 1M
कुल इनपुट टोकन 106,167 105,447
आउटपुट टोकन 32,889 7,120
रीजनिंग टोकन 241,303 230,682
प्रतिक्रिया समय (औसत) 106.32s 32.20s
प्रतिक्रिया समय (अधिकतम) 1085.11s 162.44s
प्रतिक्रिया समय (कुल) 2339.12s 708.46s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#105 Qwen3.6 27B

medium
लागत
$0.009
समय
39.6s
टोकन
3,090 tok

#107 MiMo-V2.5

medium
लागत
$0.002
समय
54.8s
टोकन
5,247 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.6 27B 7.7 10.0 66.7% 0 142.99s 5,051 7,968 43,367
MiMo-V2.5 6.2 4.7 66.7% 2 97.14s 7,422 557 81,977

त्वरित तुलना

तुलना जोड़ी बदलें