नेविगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Seed-2.0-Code (low) vs GLM 5.2 (medium)

GLM 5.2 (medium) average score में आगे है: 7.8 vs 7.7. GLM 5.2 (medium) की benchmark लागत कम है: $0.151 vs $0.767. GLM 5.2 (medium) तेज है: 23.28s vs 72.24s, pass rates 77.3% vs 80.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-24

तुलना किए गए मॉडल

रैंक
#106
कुल आउटपुट टोकन
241,309
प्रतिक्रिया समय (औसत)
72.24s
कुल लागत
$0.767
रैंक
#98
कुल आउटपुट टोकन
61,761
प्रतिक्रिया समय (औसत)
23.28s
कुल लागत
$0.151
अनुशंसित मॉडल GLM 5.2 (medium)

It has the best score here (7.8), while costing about 5.1x less than Seed-2.0-Code (low).

विस्तृत तुलना

मेट्रिक Seed-2.0-Code Seed-2.0-Code low रिलीज़: 2026-08-12 GLM 5.2 GLM 5.2 medium रिलीज़: 2026-06-17
स्कोर 7.7 7.8
रैंक #106 #98
विश्वसनीयता 8.5 9.5
संगति 7.8 8.0
प्रयास 66/66 63/66
सही परीक्षण
प्रति प्रयास पास दर 77.3% 80.3%
अस्थिर टेस्ट 6 4
कुल रन 66 63
प्रति परिणाम लागत 5.899 2.159
कुल लागत $0.767 $0.151
इनपुट कीमत $0.500 / 1M $0.650 / 1M
आउटपुट कीमत $3.000 / 1M $2.042 / 1M
कुल इनपुट टोकन 85,657 37,199
आउटपुट टोकन 8,142 12,261
रीजनिंग टोकन 233,167 49,500
प्रतिक्रिया समय (औसत) 72.24s 23.28s
प्रतिक्रिया समय (अधिकतम) 485.92s 101.36s
प्रतिक्रिया समय (कुल) 1589.31s 488.94s
पैरामीटर ~200B कुल (~20B सक्रिय) 744B कुल (40B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#106 Seed-2.0-Code

low
Provider returned error
लागत
$0.000
समय
0.3s
टोकन
0 tok

#98 GLM 5.2

medium
लागत
$0.041
समय
195.8s
टोकन
9,287 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Code 7.0 7.1 55.6% 1 109.70s 7,948 455 55,759
GLM 5.2 8.2 7.2 88.9% 1 40.96s 7,317 1,475 17,123

त्वरित तुलना

तुलना जोड़ी बदलें

Seed-2.0-CodelowvsGLM 5mediumClaude Opus 4.6mediumvsSeed-2.0-CodelowSeed-2.0-CodelowvsQwen3.7 FlashhighSeed-2.0-CodelowvsQwen3.8 27BmediumQwen3.8 27BlowvsGLM 5.2mediumSeed-2.0-CodelowvsDeepSeek V4 ProhighGPT-5.2 ChatnonevsGLM 5.2mediumSeed-2.0-CodelowvsDeepSeek V4 Flash 0423highKimi K3maxvsGLM 5.2mediumClaude Opus 4.8lowvsGLM 5.2mediumQwen3.7 FlashhighvsGLM 5.2mediumGrok 4.7lowvsGLM 5.2medium