नेविगेशन
AI BENCHY
Advertise here

AI BENCHY तुलना

Poolside: Laguna XS 2.1 vs Z.ai: GLM 5.2

सारांश

Laguna XS 2.1 vs GLM 5.2 benchmark तुलना: GLM 5.2 average score में आगे है: 7.1 vs 7.0. Laguna XS 2.1 की benchmark लागत कम है: $0.036 vs $0.051. GLM 5.2 तेज है: 6.34s vs 30.08s, pass rates 44.4% vs 60.3%.

अनुशंसित मॉडल: GLM 5.2 - It has the best score here (7.1), while responding about 4.7x faster than Laguna XS 2.1.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-02

मेट्रिक Laguna XS 2.1 Laguna XS 2.1 medium रिलीज़: 2026-07-02 निःशुल्क उपलब्ध GLM 5.2 GLM 5.2 none रिलीज़: 2026-06-17
स्कोर 7.0 7.1
रैंक #67 #63
विश्वसनीयता 10.0 9.9
संगति 9.6 9.6
सही परीक्षण
प्रति प्रयास पास दर 44.4% 60.3%
अस्थिर टेस्ट 1 1
कुल रन 63 63
प्रति परिणाम लागत 0.392 0.628
कुल लागत $0.036 $0.051
इनपुट कीमत $0.060 / 1M $0.930 / 1M
आउटपुट कीमत $0.120 / 1M $3.000 / 1M
कुल इनपुट टोकन 45,324 38,671
आउटपुट टोकन 25,761 4,817
रीजनिंग टोकन 268,677 0
प्रतिक्रिया समय (औसत) 30.08s 6.34s
प्रतिक्रिया समय (अधिकतम) 155.23s 20.69s
प्रतिक्रिया समय (कुल) 631.77s 133.19s

जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#67 Laguna XS 2.1

medium
लागत
$0.001
समय
30.6s
टोकन
4,678 tok

#63 GLM 5.2

none
अमान्य SVG
लागत
$0.033
समय
87.7s
टोकन
7,455 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Laguna XS 2.1 4.8 10.0 25.0% 0 41.96s 774 353 73,090
GLM 5.2 8.3 10.0 75.0% 0 3.70s 567 313 0
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Laguna XS 2.1 5.5 10.0 33.3% 0 70.35s 7,995 23,767 83,258
GLM 5.2 3.7 9.5 0.0% 0 7.55s 7,263 1,958 0
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Laguna XS 2.1 9.6 10.0 100.0% 0 13.43s 18,033 507 5,908
GLM 5.2 10.0 10.0 100.0% 0 20.69s 14,296 1,489 0
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Laguna XS 2.1 10.0 10.0 100.0% 0 4.50s 7,734 234 3,129
GLM 5.2 10.0 10.0 100.0% 0 7.17s 7,113 204 0
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Laguna XS 2.1 2.9 7.2 11.1% 1 65.66s 834 17 91,533
GLM 5.2 5.3 10.0 33.3% 0 6.50s 696 27 0
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Laguna XS 2.1 5.0 10.0 0.0% 0 4.15s 537 119 1,375
GLM 5.2 6.1 3.1 66.7% 1 4.42s 480 82 0
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Laguna XS 2.1 9.8 10.0 100.0% 0 2.57s 753 82 1,844
GLM 5.2 9.8 10.0 100.0% 0 3.84s 642 66 0
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Laguna XS 2.1 5.3 10.0 33.3% 0 3.43s 771 357 3,355
GLM 5.2 7.7 10.0 66.7% 0 3.31s 618 265 0
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Laguna XS 2.1 10.0 10.0 100.0% 0 3.01s 7,638 309 748
GLM 5.2 10.0 10.0 100.0% 0 15.76s 6,807 400 0
सामान्य ज्ञान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Laguna XS 2.1 3.0 10.0 0.0% 0 10.88s 255 16 4,437
GLM 5.2 3.0 10.0 0.0% 0 3.41s 189 13 0

त्वरित तुलना

तुलना जोड़ी बदलें