नेविगेशन
Advertise here

KAT-Coder-Pro V2.5 (high) vs GLM 5.1

average score लगभग बराबर है: 6.5 vs 6.5. GLM 5.1 की benchmark लागत कम है: $0.311 vs $0.506. GLM 5.1 तेज है: 11.10s vs 21.21s, pass rates 60.9% vs 47.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#198
कुल आउटपुट टोकन
144,359
प्रतिक्रिया समय (औसत)
21.21s
कुल लागत
$0.506
रैंक
#196
कुल आउटपुट टोकन
20,076
प्रतिक्रिया समय (औसत)
11.10s
कुल लागत
$0.311
अनुशंसित मॉडल GLM 5.1

It has the best score here (6.5), while costing about 1.6x less than KAT-Coder-Pro V2.5 (high).

विस्तृत तुलना

मेट्रिक KAT-Coder-Pro V2.5 KAT-Coder-Pro V2.5 high रिलीज़: 2026-07-14 GLM 5.1 GLM 5.1 none रिलीज़: 2026-04-07
स्कोर 6.5 6.5
रैंक #198 #196
विश्वसनीयता 10.0 10.0
संगति 7.9 8.2
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 60.9% 47.8%
अस्थिर टेस्ट 6 5
कुल रन 69 69
प्रति परिणाम लागत 4.599 3.478
कुल लागत $0.506 $0.311
इनपुट कीमत $0.740 / 1M $0.965 / 1M
आउटपुट कीमत $2.960 / 1M $3.032 / 1M
कुल इनपुट टोकन 106,085 258,956
आउटपुट टोकन 9,071 20,076
रीजनिंग टोकन 135,288 0
प्रतिक्रिया समय (औसत) 21.21s 11.10s
प्रतिक्रिया समय (अधिकतम) 199.97s 107.19s
प्रतिक्रिया समय (कुल) 487.83s 255.39s
पैरामीटर ~700B कुल (~72B सक्रिय) 744B कुल (40B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#198 KAT-Coder-Pro V2.5

high
लागत
$0.009
समय
26.4s
टोकन
3,117 tok

#196 GLM 5.1

none
Reached the allocated time limit (300 seconds) without receiving showcase output.
लागत
$0.000
समय
300.0s
टोकन
0 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
KAT-Coder-Pro V2.5 6.4 7.9 44.4% 1 22.00s 7,893 422 20,461
GLM 5.1 3.9 9.7 0.0% 0 4.96s 7,256 525 0

त्वरित तुलना

तुलना जोड़ी बदलें