नेव्हिगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Seed-2.0-Code (low) vs GLM 5.2 (medium)

GLM 5.2 (medium) average score मध्ये पुढे आहे: 7.8 vs 7.7. GLM 5.2 (medium) चा benchmark खर्च कमी आहे: $0.151 vs $0.767. GLM 5.2 (medium) वेगवान आहे: 23.28s vs 72.24s, pass rates 77.3% vs 80.3%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-09-24

तुलना केलेली मॉडेल्स

क्रमांक
#106
एकूण आउटपुट टोकन्स
241,309
प्रतिसाद वेळ (सरासरी)
72.24s
एकूण खर्च
$0.767
क्रमांक
#98
एकूण आउटपुट टोकन्स
61,761
प्रतिसाद वेळ (सरासरी)
23.28s
एकूण खर्च
$0.151
शिफारस केलेले मॉडेल GLM 5.2 (medium)

It has the best score here (7.8), while costing about 5.1x less than Seed-2.0-Code (low).

तपशीलवार तुलना

मेट्रिक Seed-2.0-Code Seed-2.0-Code low प्रकाशन: 2026-08-12 GLM 5.2 GLM 5.2 medium प्रकाशन: 2026-06-17
स्कोअर 7.7 7.8
क्रमांक #106 #98
विश्वसनीयता 8.5 9.5
सुसंगतता 7.8 8.0
प्रयत्न 66/66 63/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 77.3% 80.3%
अस्थिर चाचण्या 6 4
एकूण रन 66 63
प्रति निकाल खर्च 5.899 2.159
एकूण खर्च $0.767 $0.151
इनपुट किंमत $0.500 / 1M $0.650 / 1M
आउटपुट किंमत $3.000 / 1M $2.042 / 1M
एकूण इनपुट टोकन्स 85,657 37,199
आउटपुट टोकन्स 8,142 12,261
रिझनिंग टोकन्स 233,167 49,500
प्रतिसाद वेळ (सरासरी) 72.24s 23.28s
प्रतिसाद वेळ (कमाल) 485.92s 101.36s
प्रतिसाद वेळ (एकूण) 1589.31s 488.94s
पॅरामीटर्स ~200B एकूण (~20B सक्रिय) 744B एकूण (40B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#106 Seed-2.0-Code

low
Provider returned error
खर्च
$0.000
वेळ
0.3s
टोकन्स
0 tok

#98 GLM 5.2

medium
खर्च
$0.041
वेळ
195.8s
टोकन्स
9,287 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Seed-2.0-Code 7.0 7.1 55.6% 1 109.70s 7,948 455 55,759
GLM 5.2 8.2 7.2 88.9% 1 40.96s 7,317 1,475 17,123

झटपट तुलना

तुलना जोडी बदला

Seed-2.0-CodelowvsGLM 5mediumClaude Opus 4.6mediumvsSeed-2.0-CodelowSeed-2.0-CodelowvsQwen3.7 FlashhighSeed-2.0-CodelowvsQwen3.8 27BmediumQwen3.8 27BlowvsGLM 5.2mediumSeed-2.0-CodelowvsDeepSeek V4 ProhighGPT-5.2 ChatnonevsGLM 5.2mediumSeed-2.0-CodelowvsDeepSeek V4 Flash 0423highKimi K3maxvsGLM 5.2mediumClaude Opus 4.8lowvsGLM 5.2mediumQwen3.7 FlashhighvsGLM 5.2mediumGrok 4.7lowvsGLM 5.2medium