नेव्हिगेशन
AI BENCHY
Advertise here

Qwen3.7 Plus vs GLM 5.1 (medium)

average score जवळपास समान आहे: 7.2 vs 7.1. Qwen3.7 Plus चा benchmark खर्च कमी आहे: $0.106 vs $0.535. Qwen3.7 Plus वेगवान आहे: 12.09s vs 46.77s, pass rates 50.0% vs 69.7%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-25

क्रमांक
#79
एकूण आउटपुट टोकन्स
58,097
प्रतिसाद वेळ (सरासरी)
12.09s
एकूण खर्च
$0.106
क्रमांक
#82
एकूण आउटपुट टोकन्स
152,552
प्रतिसाद वेळ (सरासरी)
46.77s
एकूण खर्च
$0.535
शिफारस केलेले मॉडेल Qwen3.7 Plus

It has the best score here (7.2), while costing about 5.0x less than GLM 5.1 (medium).

तपशीलवार तुलना

मेट्रिक Qwen3.7 Plus Qwen3.7 Plus none प्रकाशन: 2026-06-03 GLM 5.1 GLM 5.1 medium प्रकाशन: 2026-04-07
स्कोअर 7.2 7.1
क्रमांक #79 #82
विश्वसनीयता 10.0 8.3
सुसंगतता 10.0 8.4
बरोबर चाचण्या
प्रति प्रयत्न पास दर 50.0% 69.7%
अस्थिर चाचण्या 0 4
एकूण रन 66 66
प्रति निकाल खर्च 1.014 4.202
एकूण खर्च $0.106 $0.535
इनपुट किंमत $0.320 / 1M $0.966 / 1M
आउटपुट किंमत $1.280 / 1M $3.036 / 1M
एकूण इनपुट टोकन्स 98,824 82,623
आउटपुट टोकन्स 58,097 16,089
रिझनिंग टोकन्स 0 136,463
प्रतिसाद वेळ (सरासरी) 12.09s 46.77s
प्रतिसाद वेळ (कमाल) 206.03s 308.75s
प्रतिसाद वेळ (एकूण) 265.89s 982.16s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#79 Qwen3.7 Plus

none
खर्च
$0.019
वेळ
213.5s
टोकन्स
11,960 tok

#82 GLM 5.1

medium
अवैध SVG
खर्च
$0.000
वेळ
300.0s
टोकन्स
0 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.7 Plus 5.5 10.0 33.3% 0 2.15s 7,911 639 0
GLM 5.1 4.6 3.7 44.5% 2 109.63s 5,702 4,871 37,826

झटपट तुलना

तुलना जोडी बदला