नेव्हिगेशन
AI BENCHY
Advertise here

Qwen3.7 Plus vs GLM 5.3 (high)

average score जवळपास समान आहे: 7.3 vs 7.3. Qwen3.7 Plus चा benchmark खर्च कमी आहे: $0.106 vs $0.403. Qwen3.7 Plus वेगवान आहे: 12.11s vs 27.82s, pass rates 54.6% vs 74.2%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-20

क्रमांक
#102
एकूण आउटपुट टोकन्स
58,097
प्रतिसाद वेळ (सरासरी)
12.11s
एकूण खर्च
$0.106
क्रमांक
#99
एकूण आउटपुट टोकन्स
63,667
प्रतिसाद वेळ (सरासरी)
27.82s
एकूण खर्च
$0.403
शिफारस केलेले मॉडेल Qwen3.7 Plus

It has the best score here (7.3), while costing about 3.8x less than GLM 5.3 (high).

तपशीलवार तुलना

मेट्रिक Qwen3.7 Plus Qwen3.7 Plus none प्रकाशन: 2026-06-03 GLM 5.3 GLM 5.3 high प्रकाशन: 2026-08-20
स्कोअर 7.3 7.3
क्रमांक #102 #99
विश्वसनीयता 10.0 10.0
सुसंगतता 10.0 7.5
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 54.6% 74.2%
अस्थिर चाचण्या 0 7
एकूण रन 66 66
प्रति निकाल खर्च 0.930 3.099
एकूण खर्च $0.106 $0.403
इनपुट किंमत $0.320 / 1M $1.400 / 1M
आउटपुट किंमत $1.280 / 1M $4.400 / 1M
एकूण इनपुट टोकन्स 98,833 87,601
आउटपुट टोकन्स 58,097 6,006
रिझनिंग टोकन्स 0 57,661
प्रतिसाद वेळ (सरासरी) 12.11s 27.82s
प्रतिसाद वेळ (कमाल) 206.03s 159.91s
प्रतिसाद वेळ (एकूण) 266.40s 612.06s
पॅरामीटर्स ~397B एकूण (~17B सक्रिय) 744B एकूण (40B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#102 Qwen3.7 Plus

none
खर्च
$0.019
वेळ
213.5s
टोकन्स
11,960 tok

#99 GLM 5.3

high
खर्च
$0.085
वेळ
362.5s
टोकन्स
19,310 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.7 Plus 5.5 10.0 33.3% 0 2.15s 7,911 639 0
GLM 5.3 6.6 5.0 66.7% 2 18.89s 7,317 473 8,190

झटपट तुलना

तुलना जोडी बदला