नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

KAT-Coder-Pro V2.5 vs GLM 5.3 (low)

average score लगभग बराबर है: 6.7 vs 6.8. GLM 5.3 (low) की benchmark लागत कम है: $0.257 vs $0.487. GLM 5.3 (low) तेज है: 13.65s vs 26.01s, pass rates 71.2% vs 65.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-20

रैंक
#139
कुल आउटपुट टोकन
139,572
प्रतिक्रिया समय (औसत)
26.01s
कुल लागत
$0.487
रैंक
#134
कुल आउटपुट टोकन
24,808
प्रतिक्रिया समय (औसत)
13.65s
कुल लागत
$0.257
अनुशंसित मॉडल GLM 5.3 (low)

It has the best score here (6.8), while costing about 1.9x less than KAT-Coder-Pro V2.5.

विस्तृत तुलना

मेट्रिक KAT-Coder-Pro V2.5 KAT-Coder-Pro V2.5 none रिलीज़: 2026-07-14 GLM 5.3 GLM 5.3 low रिलीज़: 2026-08-20
स्कोर 6.7 6.8
रैंक #139 #134
विश्वसनीयता 10.0 10.0
संगति 7.0 8.5
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 71.2% 65.2%
अस्थिर टेस्ट 8 4
कुल रन 66 66
प्रति परिणाम लागत 4.419 2.135
कुल लागत $0.487 $0.257
इनपुट कीमत $0.740 / 1M $1.400 / 1M
आउटपुट कीमत $2.960 / 1M $4.400 / 1M
कुल इनपुट टोकन 98,508 104,989
आउटपुट टोकन 139,572 8,532
रीजनिंग टोकन 0 16,276
प्रतिक्रिया समय (औसत) 26.01s 13.65s
प्रतिक्रिया समय (अधिकतम) 335.41s 83.60s
प्रतिक्रिया समय (कुल) 572.22s 300.22s
पैरामीटर ~700B कुल (~72B सक्रिय) 744B कुल (40B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#139 KAT-Coder-Pro V2.5

none
लागत
$0.010
समय
29.0s
टोकन
3,439 tok

#134 GLM 5.3

low
लागत
$0.007
समय
28.4s
टोकन
1,599 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
KAT-Coder-Pro V2.5 6.1 4.7 66.7% 2 22.52s 7,893 22,440 0
GLM 5.3 6.2 6.9 55.6% 1 21.02s 7,317 368 6,764

त्वरित तुलना

तुलना जोड़ी बदलें