नेविगेशन
AI BENCHY
Advertise here

Seed-2.0-Code (medium) vs GLM 5.3 (low)

Seed-2.0-Code (medium) average score में आगे है: 6.8 vs 6.8. GLM 5.3 (low) की benchmark लागत कम है: $0.257 vs $1.153. GLM 5.3 (low) तेज है: 13.65s vs 101.05s, pass rates 63.6% vs 65.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-20

रैंक
#130
कुल आउटपुट टोकन
371,443
प्रतिक्रिया समय (औसत)
101.05s
कुल लागत
$1.153
रैंक
#134
कुल आउटपुट टोकन
24,808
प्रतिक्रिया समय (औसत)
13.65s
कुल लागत
$0.257
अनुशंसित मॉडल GLM 5.3 (low)

Its score stays close to the best score here (6.8 vs 6.8), while costing about 4.5x less than Seed-2.0-Code (medium).

विस्तृत तुलना

मेट्रिक Seed-2.0-Code Seed-2.0-Code medium रिलीज़: 2026-08-12 GLM 5.3 GLM 5.3 low रिलीज़: 2026-08-20
स्कोर 6.8 6.8
रैंक #130 #134
विश्वसनीयता 7.3 10.0
संगति 7.3 8.5
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 63.6% 65.2%
अस्थिर टेस्ट 7 4
कुल रन 66 66
प्रति परिणाम लागत 11.524 2.135
कुल लागत $1.153 $0.257
इनपुट कीमत $0.500 / 1M $1.400 / 1M
आउटपुट कीमत $3.000 / 1M $4.400 / 1M
कुल इनपुट टोकन 76,036 104,989
आउटपुट टोकन 7,267 8,532
रीजनिंग टोकन 364,176 16,276
प्रतिक्रिया समय (औसत) 101.05s 13.65s
प्रतिक्रिया समय (अधिकतम) 626.58s 83.60s
प्रतिक्रिया समय (कुल) 2223.19s 300.22s
पैरामीटर ~200B कुल (~20B सक्रिय) 744B कुल (40B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#130 Seed-2.0-Code

medium
लागत
$0.026
समय
122.8s
टोकन
8,630 tok

#134 GLM 5.3

low
लागत
$0.007
समय
28.4s
टोकन
1,599 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Code 8.9 7.8 88.9% 1 89.94s 8,247 496 44,062
GLM 5.3 6.2 6.9 55.6% 1 21.02s 7,317 368 6,764

त्वरित तुलना

तुलना जोड़ी बदलें