नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Poolside: Laguna S 2.1 vs Z.ai: GLM 4.7 Flash

Laguna S 2.1 (low) average score में आगे है: 5.0 vs 4.9. GLM 4.7 Flash की benchmark लागत कम है: $0.016 vs $0.091. GLM 4.7 Flash तेज है: 9.15s vs 85.35s, pass rates 25.8% vs 34.9%.

अनुशंसित मॉडलGLM 4.7 FlashIts score stays close to the best score here (4.9 vs 5.0), while costing about 5.9x less than Laguna S 2.1 (low).

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-22

मेट्रिक Laguna S 2.1 Laguna S 2.1 low रिलीज़: 2026-07-21 निःशुल्क उपलब्ध GLM 4.7 Flash GLM 4.7 Flash none रिलीज़: 2026-01-19
स्कोर 5.0 4.9
रैंक #181 #185
विश्वसनीयता 9.9 10.0
संगति 7.8 8.9
सही परीक्षण
प्रति प्रयास पास दर 25.8% 34.9%
अस्थिर टेस्ट 6 3
कुल रन 66 66
प्रति परिणाम लागत 3.022 0.256
कुल लागत $0.091 $0.016
इनपुट कीमत $0.100 / 1M $0.061 / 1M
आउटपुट कीमत $0.200 / 1M $0.400 / 1M
कुल इनपुट टोकन 118,746 101,504
आउटपुट टोकन 67,823 22,992
रीजनिंग टोकन 383,885 0
प्रतिक्रिया समय (औसत) 85.35s 9.15s
प्रतिक्रिया समय (अधिकतम) 814.73s 97.15s
प्रतिक्रिया समय (कुल) 1877.64s 137.18s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#181 Laguna S 2.1

low
लागत
$0.001
समय
6.6s
टोकन
1,314 tok

#185 GLM 4.7 Flash

none
अमान्य SVG
लागत
$0.000
समय
300.0s
टोकन
0 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Laguna S 2.1 3.8 7.1 22.2% 1 167.51s 7,917 58,111 119,138
GLM 4.7 Flash 4.3 10.0 0.0% 0 2.54s 7,256 650 0

त्वरित तुलना

तुलना जोड़ी बदलें