नेविगेशन
AI BENCHY
Advertise here

AI BENCHY तुलना

Poolside: Laguna XS 2.1 vs Z.ai: GLM 5

सारांश

Laguna XS 2.1 vs GLM 5 benchmark तुलना: GLM 5 average score में आगे है: 6.0 vs 5.3. Laguna XS 2.1 की benchmark लागत कम है: $0.003 vs $0.027. Laguna XS 2.1 तेज है: 722ms vs 4.03s, pass rates 31.8% vs 44.4%.

अनुशंसित मॉडल: GLM 5 - It has the strongest score in this comparison (6.0) and the best overall balance of cost and response time across all 2 models.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-02

मेट्रिक Laguna XS 2.1 Laguna XS 2.1 none रिलीज़: 2026-07-02 निःशुल्क उपलब्ध GLM 5 GLM 5 none रिलीज़: 2026-02-12
स्कोर 5.3 6.0
रैंक #128 #104
विश्वसनीयता 10.0 10.0
संगति 9.0 9.7
सही परीक्षण
प्रति प्रयास पास दर 31.8% 44.4%
अस्थिर टेस्ट 3 1
कुल रन 63 63
प्रति परिणाम लागत 0.058 0.263
कुल लागत $0.003 $0.027
इनपुट कीमत $0.060 / 1M $0.600 / 1M
आउटपुट कीमत $0.120 / 1M $1.920 / 1M
कुल इनपुट टोकन 41,148 37,135
आउटपुट टोकन 3,451 1,989
रीजनिंग टोकन 0 0
प्रतिक्रिया समय (औसत) 722ms 4.03s
प्रतिक्रिया समय (अधिकतम) 2.30s 11.07s
प्रतिक्रिया समय (कुल) 15.17s 56.37s

जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#128 Laguna XS 2.1

none
लागत
$0.001
समय
27.6s
टोकन
4,344 tok

#104 GLM 5

none
लागत
$0.007
समय
32.1s
टोकन
2,023 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Laguna XS 2.1 5.3 8.3 33.3% 1 755ms 774 1,015 0
GLM 5 4.8 10.0 25.0% 0 2.37s 510 275 0
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Laguna XS 2.1 4.3 7.8 22.2% 1 623ms 7,995 562 0
GLM 5 4.0 7.8 11.1% 1 5.12s 7,256 428 0
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Laguna XS 2.1 3.0 10.0 0.0% 0 1.76s 14,197 402 0
GLM 5 3.0 10.0 0.0% 0 4.98s 12,812 406 0
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Laguna XS 2.1 10.0 10.0 100.0% 0 768ms 7,734 240 0
GLM 5 10.0 10.0 100.0% 0 5.78s 7,107 203 0
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Laguna XS 2.1 5.3 10.0 33.3% 0 364ms 834 14 0
GLM 5 3.0 10.0 0.0% 0 2.24s 643 19 0
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Laguna XS 2.1 5.0 10.0 0.0% 0 529ms 537 128 0
GLM 5 10.0 10.0 100.0% 0 3.27s 477 103 0
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Laguna XS 2.1 3.8 5.8 33.3% 1 364ms 638 50 0
GLM 5 10.0 10.0 100.0% 0 1.48s 636 61 0
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Laguna XS 2.1 3.0 10.0 0.0% 0 1.01s 771 730 0
GLM 5 7.7 10.0 66.7% 0 1.91s 609 261 0
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Laguna XS 2.1 10.0 10.0 100.0% 0 1.36s 7,413 300 0
GLM 5 10.0 10.0 100.0% 0 11.07s 6,899 220 0
सामान्य ज्ञान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Laguna XS 2.1 3.0 10.0 0.0% 0 254ms 255 10 0
GLM 5 3.0 10.0 0.0% 0 3.62s 186 13 0

त्वरित तुलना

तुलना जोड़ी बदलें