नेव्हिगेशन
AI BENCHY
Advertise here

Qwen3.5-27B (medium) vs Qwen3.7 Max

average score जवळपास समान आहे: 7.5 vs 7.4. Qwen3.7 Max चा benchmark खर्च कमी आहे: $0.197 vs $0.982. Qwen3.7 Max वेगवान आहे: 4.56s vs 113.28s, pass rates 75.8% vs 68.2%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-29

क्रमांक
#88
एकूण आउटपुट टोकन्स
614,909
प्रतिसाद वेळ (सरासरी)
113.28s
एकूण खर्च
$0.982
क्रमांक
#92
एकूण आउटपुट टोकन्स
12,446
प्रतिसाद वेळ (सरासरी)
4.56s
एकूण खर्च
$0.197
शिफारस केलेले मॉडेल Qwen3.7 Max

It has the best score here (7.4), while costing about 5.0x less than Qwen3.5-27B (medium).

तपशीलवार तुलना

मेट्रिक Qwen3.5-27B Qwen3.5-27B medium प्रकाशन: 2026-02-24 Qwen3.7 Max Qwen3.7 Max none प्रकाशन: 2026-05-22
स्कोअर 7.5 7.4
क्रमांक #88 #92
विश्वसनीयता 10.0 9.9
सुसंगतता 7.8 10.0
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 75.8% 68.2%
अस्थिर चाचण्या 6 0
एकूण रन 66 66
प्रति निकाल खर्च 8.217 1.581
एकूण खर्च $0.982 $0.197
इनपुट किंमत $0.195 / 1M $1.475 / 1M
आउटपुट किंमत $1.560 / 1M $4.425 / 1M
एकूण इनपुट टोकन्स 111,644 95,992
आउटपुट टोकन्स 16,113 12,446
रिझनिंग टोकन्स 598,796 0
प्रतिसाद वेळ (सरासरी) 113.28s 4.56s
प्रतिसाद वेळ (कमाल) 1026.43s 72.30s
प्रतिसाद वेळ (एकूण) 2492.26s 100.30s
पॅरामीटर्स 27B ~1T एकूण (~40B सक्रिय)
उपलब्धता मुक्त स्रोत बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#88 Qwen3.5-27B

medium
खर्च
$0.008
वेळ
62.0s
टोकन्स
3,099 tok

#92 Qwen3.7 Max

none
खर्च
$0.046
वेळ
195.0s
टोकन्स
12,171 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-27B 6.2 7.1 55.6% 1 160.69s 7,895 6,381 89,388
Qwen3.7 Max 5.5 10.0 33.3% 0 1.35s 7,911 582 0

झटपट तुलना

तुलना जोडी बदला