नेविगेशन
AI BENCHY
Advertise here

KAT-Coder-Air V2.5 (high) vs GLM 5

GLM 5 average score में आगे है: 5.7 vs 5.6. GLM 5 की benchmark लागत कम है: $0.027 vs $0.077. GLM 5 तेज है: 4.03s vs 15.87s, pass rates 42.4% vs 42.4%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-02

रैंक
#220
कुल आउटपुट टोकन
114,654
प्रतिक्रिया समय (औसत)
15.87s
कुल लागत
$0.077
रैंक
#213
कुल आउटपुट टोकन
1,989
प्रतिक्रिया समय (औसत)
4.03s
कुल लागत
$0.027
अनुशंसित मॉडल GLM 5

It has the best score here (5.7), while costing about 2.9x less than KAT-Coder-Air V2.5 (high).

विस्तृत तुलना

मेट्रिक KAT-Coder-Air V2.5 KAT-Coder-Air V2.5 high रिलीज़: 2026-07-14 GLM 5 GLM 5 none रिलीज़: 2026-02-12
स्कोर 5.6 5.7
रैंक #220 #213
विश्वसनीयता 9.8 10.0
संगति 8.1 9.3
प्रयास 66/66 63/66
सही परीक्षण
प्रति प्रयास पास दर 42.4% 42.4%
अस्थिर टेस्ट 5 1
कुल रन 66 63
प्रति परिणाम लागत 1.091 0.263
कुल लागत $0.077 $0.027
इनपुट कीमत $0.150 / 1M $0.600 / 1M
आउटपुट कीमत $0.600 / 1M $1.920 / 1M
कुल इनपुट टोकन 50,423 37,135
आउटपुट टोकन 4,144 1,989
रीजनिंग टोकन 110,510 0
प्रतिक्रिया समय (औसत) 15.87s 4.03s
प्रतिक्रिया समय (अधिकतम) 118.35s 11.07s
प्रतिक्रिया समय (कुल) 349.16s 56.37s
पैरामीटर ~35B कुल (~3B सक्रिय) 744B कुल (40B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#220 KAT-Coder-Air V2.5

high
अमान्य SVG
लागत
$0.000
समय
300.0s
टोकन
0 tok

#213 GLM 5

none
लागत
$0.007
समय
32.1s
टोकन
2,023 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
KAT-Coder-Air V2.5 4.3 7.3 11.1% 1 39.07s 6,948 1,166 55,883
GLM 5 4.0 7.8 11.1% 1 5.12s 7,256 428 0

त्वरित तुलना

तुलना जोड़ी बदलें