नेव्हिगेशन
AI BENCHY
Advertise here

Qwen3.7 Flash (high) vs GLM 5.2 (medium)

GLM 5.2 (medium) average score मध्ये पुढे आहे: 7.8 vs 7.8. Qwen3.7 Flash (high) चा benchmark खर्च कमी आहे: $0.051 vs $0.178. GLM 5.2 (medium) वेगवान आहे: 23.28s vs 39.77s, pass rates 72.7% vs 80.3%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-28

क्रमांक
#48
एकूण आउटपुट टोकन्स
359,703
प्रतिसाद वेळ (सरासरी)
39.77s
एकूण खर्च
$0.051
क्रमांक
#45
एकूण आउटपुट टोकन्स
61,761
प्रतिसाद वेळ (सरासरी)
23.28s
एकूण खर्च
$0.178
शिफारस केलेले मॉडेल Qwen3.7 Flash (high)

Its score stays close to the best score here (7.8 vs 7.8), while costing about 3.5x less than GLM 5.2 (medium).

तपशीलवार तुलना

मेट्रिक Qwen3.7 Flash Qwen3.7 Flash high प्रकाशन: 2026-07-28 GLM 5.2 GLM 5.2 medium प्रकाशन: 2026-06-17
स्कोअर 7.8 7.8
क्रमांक #48 #45
विश्वसनीयता 10.0 9.5
सुसंगतता 7.8 8.0
बरोबर चाचण्या
प्रति प्रयत्न पास दर 72.7% 80.3%
अस्थिर चाचण्या 6 4
एकूण रन 66 63
प्रति निकाल खर्च 0.387 2.159
एकूण खर्च $0.051 $0.178
इनपुट किंमत $0.030 / 1M $0.769 / 1M
आउटपुट किंमत $0.130 / 1M $2.416 / 1M
एकूण इनपुट टोकन्स 116,322 37,199
आउटपुट टोकन्स 12,332 12,261
रिझनिंग टोकन्स 347,371 49,500
प्रतिसाद वेळ (सरासरी) 39.77s 23.28s
प्रतिसाद वेळ (कमाल) 431.47s 101.36s
प्रतिसाद वेळ (एकूण) 875.01s 488.94s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#48 Qwen3.7 Flash

high
अवैध SVG
खर्च
$0.000
वेळ
600.0s
टोकन्स
0 tok

#45 GLM 5.2

medium
खर्च
$0.041
वेळ
195.8s
टोकन्स
9,287 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.7 Flash 8.2 9.7 66.7% 0 58.84s 7,893 503 62,350
GLM 5.2 8.2 7.2 88.9% 1 40.96s 7,317 1,475 17,123

झटपट तुलना

तुलना जोडी बदला