नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Poolside: Laguna S 2.1 vs Z.ai: GLM 5

GLM 5 average score में आगे है: 5.7 vs 5.4. GLM 5 की benchmark लागत कम है: $0.041 vs $0.059. GLM 5 तेज है: 4.03s vs 58.43s, pass rates 25.8% vs 42.4%.

अनुशंसित मॉडलGLM 5It has the best score here (5.7), while responding about 14.5x faster than Laguna S 2.1 (medium).

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-24

मेट्रिक Laguna S 2.1 Laguna S 2.1 medium रिलीज़: 2026-07-21 निःशुल्क उपलब्ध GLM 5 GLM 5 none रिलीज़: 2026-02-12
स्कोर 5.4 5.7
रैंक #166 #148
विश्वसनीयता 9.8 10.0
संगति 8.4 9.3
सही परीक्षण
प्रति प्रयास पास दर 25.8% 42.4%
अस्थिर टेस्ट 4 1
कुल रन 66 63
प्रति परिणाम लागत 1.451 0.263
कुल लागत $0.059 $0.041
इनपुट कीमत $0.100 / 1M $0.950 / 1M
आउटपुट कीमत $0.200 / 1M $2.551 / 1M
कुल इनपुट टोकन 86,641 37,135
आउटपुट टोकन 97,298 1,989
रीजनिंग टोकन 242,297 0
प्रतिक्रिया समय (औसत) 58.43s 4.03s
प्रतिक्रिया समय (अधिकतम) 560.31s 11.07s
प्रतिक्रिया समय (कुल) 1285.48s 56.37s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#166 Laguna S 2.1

medium
लागत
$0.001
समय
4.0s
टोकन
867 tok

#148 GLM 5

none
लागत
$0.007
समय
32.1s
टोकन
2,023 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Laguna S 2.1 5.3 7.2 44.4% 1 158.98s 7,917 93,354 106,718
GLM 5 4.0 7.8 11.1% 1 5.12s 7,256 428 0

त्वरित तुलना

तुलना जोड़ी बदलें