नेव्हिगेशन
AI BENCHY
Advertise here

Qwen3.7 Max vs MiMo-V2.5 (medium)

Qwen3.7 Max average score मध्ये पुढे आहे: 7.4 vs 6.4. MiMo-V2.5 (medium) चा benchmark खर्च कमी आहे: $0.104 vs $0.197. Qwen3.7 Max वेगवान आहे: 4.56s vs 46.28s, pass rates 68.2% vs 68.2%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-20

क्रमांक
#91
एकूण आउटपुट टोकन्स
12,446
प्रतिसाद वेळ (सरासरी)
4.56s
एकूण खर्च
$0.197
क्रमांक
#160
एकूण आउटपुट टोकन्स
327,048
प्रतिसाद वेळ (सरासरी)
46.28s
एकूण खर्च
$0.104
शिफारस केलेले मॉडेल Qwen3.7 Max

It has the best score here (7.4), while responding about 10.2x faster than MiMo-V2.5 (medium).

तपशीलवार तुलना

मेट्रिक Qwen3.7 Max Qwen3.7 Max none प्रकाशन: 2026-05-22 MiMo-V2.5 MiMo-V2.5 medium प्रकाशन: 2026-04-22
स्कोअर 7.4 6.4
क्रमांक #91 #160
विश्वसनीयता 9.9 10.0
सुसंगतता 10.0 7.5
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 68.2% 68.2%
अस्थिर चाचण्या 0 7
एकूण रन 66 66
प्रति निकाल खर्च 1.581 3.575
एकूण खर्च $0.197 $0.104
इनपुट किंमत $1.475 / 1M $0.140 / 1M
आउटपुट किंमत $4.425 / 1M $0.280 / 1M
एकूण इनपुट टोकन्स 95,992 105,456
आउटपुट टोकन्स 12,446 7,108
रिझनिंग टोकन्स 0 319,940
प्रतिसाद वेळ (सरासरी) 4.56s 46.28s
प्रतिसाद वेळ (कमाल) 72.30s 316.27s
प्रतिसाद वेळ (एकूण) 100.30s 1018.12s
पॅरामीटर्स ~1T एकूण (~40B सक्रिय) 310B एकूण (15B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#91 Qwen3.7 Max

none
खर्च
$0.046
वेळ
195.0s
टोकन्स
12,171 tok

#160 MiMo-V2.5

medium
खर्च
$0.002
वेळ
54.8s
टोकन्स
5,247 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.7 Max 5.5 10.0 33.3% 0 1.35s 7,911 582 0
MiMo-V2.5 6.2 4.7 66.7% 2 97.14s 7,422 557 81,977

झटपट तुलना

तुलना जोडी बदला