नेविगेशन
AI BENCHY
Advertise here

Laguna XS 2.1 (medium) vs GLM 5.2

GLM 5.2 average score में आगे है: 6.7 vs 6.5. Laguna XS 2.1 (medium) की benchmark लागत कम है: $0.068 vs $0.153. GLM 5.2 तेज है: 9.65s vs 48.18s, pass rates 45.5% vs 63.6%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-20

रैंक
#153
कुल आउटपुट टोकन
522,480
प्रतिक्रिया समय (औसत)
48.18s
कुल लागत
$0.068
रैंक
#138
कुल आउटपुट टोकन
14,344
प्रतिक्रिया समय (औसत)
9.65s
कुल लागत
$0.153
अनुशंसित मॉडल GLM 5.2

It has the best score here (6.7), while responding about 5.0x faster than Laguna XS 2.1 (medium).

विस्तृत तुलना

मेट्रिक Laguna XS 2.1 Laguna XS 2.1 medium रिलीज़: 2026-07-02 निःशुल्क उपलब्ध GLM 5.2 GLM 5.2 none रिलीज़: 2026-06-17
स्कोर 6.5 6.7
रैंक #153 #138
विश्वसनीयता 10.0 10.0
संगति 9.2 9.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 45.5% 63.6%
अस्थिर टेस्ट 2 2
कुल रन 66 66
प्रति परिणाम लागत 0.745 1.312
कुल लागत $0.068 $0.153
इनपुट कीमत $0.060 / 1M $0.966 / 1M
आउटपुट कीमत $0.120 / 1M $3.036 / 1M
कुल इनपुट टोकन 118,998 112,458
आउटपुट टोकन 30,750 14,344
रीजनिंग टोकन 491,730 0
प्रतिक्रिया समय (औसत) 48.18s 9.65s
प्रतिक्रिया समय (अधिकतम) 422.72s 79.65s
प्रतिक्रिया समय (कुल) 1059.93s 212.38s
पैरामीटर 33B कुल (3B सक्रिय) 744B कुल (40B सक्रिय)
उपलब्धता वेट उपलब्ध मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#153 Laguna XS 2.1

medium
लागत
$0.001
समय
30.6s
टोकन
4,678 tok

#138 GLM 5.2

none
अमान्य SVG
लागत
$0.033
समय
87.7s
टोकन
7,455 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Laguna XS 2.1 5.5 10.0 33.3% 0 70.35s 7,995 23,767 83,258
GLM 5.2 3.7 9.5 0.0% 0 7.55s 7,263 1,958 0

त्वरित तुलना

तुलना जोड़ी बदलें