नेव्हिगेशन
AI BENCHY
Advertise here

Qwen3.7 Max vs GLM 5 (medium)

GLM 5 (medium) average score मध्ये पुढे आहे: 7.7 vs 7.4. Qwen3.7 Max चा benchmark खर्च कमी आहे: $0.197 vs $0.307. Qwen3.7 Max वेगवान आहे: 4.52s vs 33.54s, pass rates 68.2% vs 78.8%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-25

क्रमांक
#67
एकूण आउटपुट टोकन्स
12,446
प्रतिसाद वेळ (सरासरी)
4.52s
एकूण खर्च
$0.197
क्रमांक
#49
एकूण आउटपुट टोकन्स
124,566
प्रतिसाद वेळ (सरासरी)
33.54s
एकूण खर्च
$0.307
शिफारस केलेले मॉडेल Qwen3.7 Max

Its score stays close to the best score here (7.4 vs 7.7), while costing about 1.6x less than GLM 5 (medium).

तपशीलवार तुलना

मेट्रिक Qwen3.7 Max Qwen3.7 Max none प्रकाशन: 2026-05-22 GLM 5 GLM 5 medium प्रकाशन: 2026-02-12
स्कोअर 7.4 7.7
क्रमांक #67 #49
विश्वसनीयता 9.9 10.0
सुसंगतता 10.0 8.1
बरोबर चाचण्या
प्रति प्रयत्न पास दर 68.2% 78.8%
अस्थिर चाचण्या 0 4
एकूण रन 66 63
प्रति निकाल खर्च 1.582 1.668
एकूण खर्च $0.197 $0.307
इनपुट किंमत $1.475 / 1M $0.950 / 1M
आउटपुट किंमत $4.425 / 1M $2.551 / 1M
एकूण इनपुट टोकन्स 95,983 35,224
आउटपुट टोकन्स 12,446 21,570
रिझनिंग टोकन्स 0 102,996
प्रतिसाद वेळ (सरासरी) 4.52s 33.54s
प्रतिसाद वेळ (कमाल) 72.30s 99.85s
प्रतिसाद वेळ (एकूण) 99.52s 435.99s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#67 Qwen3.7 Max

none
खर्च
$0.046
वेळ
195.0s
टोकन्स
12,171 tok

#49 GLM 5

medium
खर्च
$0.005
वेळ
20.7s
टोकन्स
2,068 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.7 Max 5.5 10.0 33.3% 0 1.35s 7,911 582 0
GLM 5 10.0 10.0 100.0% 0 74.30s 7,254 2,997 52,930

झटपट तुलना

तुलना जोडी बदला