नेविगेशन
AI BENCHY
Advertise here

Qwen3.5 Plus 2026-02-15 (medium) vs GLM 5.2 (high)

GLM 5.2 (high) average score में आगे है: 8.0 vs 7.5. Qwen3.5 Plus 2026-02-15 (medium) की benchmark लागत कम है: $0.437 vs $0.778. GLM 5.2 (high) तेज है: 62.65s vs 89.19s, pass rates 71.2% vs 71.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-05

रैंक
#75
कुल आउटपुट टोकन
260,704
प्रतिक्रिया समय (औसत)
89.19s
कुल लागत
$0.437
रैंक
#45
कुल आउटपुट टोकन
295,347
प्रतिक्रिया समय (औसत)
62.65s
कुल लागत
$0.778
अनुशंसित मॉडल GLM 5.2 (high)

It has the strongest score in this comparison (8.0) and the best overall balance of cost and response time across all 2 models.

विस्तृत तुलना

मेट्रिक Qwen3.5 Plus 2026-02-15 Qwen3.5 Plus 2026-02-15 medium रिलीज़: 2026-02-15 GLM 5.2 GLM 5.2 high रिलीज़: 2026-06-17
स्कोर 7.5 8.0
रैंक #75 #45
विश्वसनीयता 10.0 10.0
संगति 8.5 8.6
बेंचमार्क कवरेज 22/22 टेस्ट · 66/66 प्रयास 22/22 टेस्ट · 66/66 प्रयास
सही परीक्षण
प्रति प्रयास पास दर 71.2% 71.2%
अस्थिर टेस्ट 4 3
कुल रन 66 66
प्रति परिणाम लागत 3.348 5.873
कुल लागत $0.437 $0.778
इनपुट कीमत $0.260 / 1M $0.760 / 1M
आउटपुट कीमत $1.560 / 1M $2.420 / 1M
कुल इनपुट टोकन 113,560 83,813
आउटपुट टोकन 9,823 69,688
रीजनिंग टोकन 250,881 225,659
प्रतिक्रिया समय (औसत) 89.19s 62.65s
प्रतिक्रिया समय (अधिकतम) 304.85s 599.43s
प्रतिक्रिया समय (कुल) 1337.92s 1378.34s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#75 Qwen3.5 Plus 2026-02-15

medium
लागत
$0.011
समय
125.5s
टोकन
7,040 tok

#45 GLM 5.2

high
अमान्य SVG
लागत
$0.000
समय
300.0s
टोकन
0 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.5 Plus 2026-02-15 6.6 7.1 44.4% 1 180.70s 6,950 420 80,595
GLM 5.2 6.4 8.6 33.3% 0 73.03s 5,124 2,302 22,546

त्वरित तुलना

तुलना जोड़ी बदलें