नेविगेशन
Advertise here

Hy4 preview (low) vs GLM 5.1

GLM 5.1 average score में आगे है: 5.7 vs 5.6. GLM 5.1 की benchmark लागत कम है: $0.164 vs $1.745. GLM 5.1 तेज है: 6.74s vs 214.25s, pass rates 19.7% vs 45.5%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-23

तुलना किए गए मॉडल

रैंक
#266
कुल आउटपुट टोकन
682,538
प्रतिक्रिया समय (औसत)
214.25s
कुल लागत
$1.745
रैंक
#253
कुल आउटपुट टोकन
14,393
प्रतिक्रिया समय (औसत)
6.74s
कुल लागत
$0.164
अनुशंसित मॉडल GLM 5.1

It has the best score here (5.7), while costing about 10.7x less than Hy4 preview (low).

विस्तृत तुलना

मेट्रिक Hy4 preview Hy4 preview low रिलीज़: 2026-08-29 GLM 5.1 GLM 5.1 none रिलीज़: 2026-04-07
स्कोर 5.6 5.7
रैंक #266 #253
विश्वसनीयता 5.4 10.0
संगति 8.5 8.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 19.7% 45.5%
अस्थिर टेस्ट 3 5
कुल रन 66 66
प्रति परिणाम लागत 58.157 2.073
कुल लागत $1.745 $0.164
इनपुट कीमत $0.834 / 1M $0.966 / 1M
आउटपुट कीमत $2.501 / 1M $3.036 / 1M
कुल इनपुट टोकन 45,154 124,219
आउटपुट टोकन 4,022 14,393
रीजनिंग टोकन 678,516 0
प्रतिक्रिया समय (औसत) 214.25s 6.74s
प्रतिक्रिया समय (अधिकतम) 597.45s 61.20s
प्रतिक्रिया समय (कुल) 4713.56s 148.20s
पैरामीटर 770B कुल (49B सक्रिय) 744B कुल (40B सक्रिय)
उपलब्धता मुक्त स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#266 Hy4 preview

low
Provider returned error
लागत
$0.000
समय
1.1s
टोकन
0 tok

#253 GLM 5.1

none
Reached the allocated time limit (300 seconds) without receiving showcase output.
लागत
$0.000
समय
300.0s
टोकन
0 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Hy4 preview 5.2 8.6 0.0% 0 219.15s 6,110 135 96,407
GLM 5.1 3.9 9.7 0.0% 0 4.96s 7,256 525 0

त्वरित तुलना

तुलना जोड़ी बदलें