नेविगेशन
AI BENCHY
Advertise here

KAT-Coder-Pro V2.5 (low) vs GLM 5.3 (high)

average score लगभग बराबर है: 7.3 vs 7.3. KAT-Coder-Pro V2.5 (low) की benchmark लागत कम है: $0.400 vs $0.403. KAT-Coder-Pro V2.5 (low) तेज है: 20.20s vs 27.82s, pass rates 68.2% vs 74.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-20

रैंक
#100
कुल आउटपुट टोकन
113,193
प्रतिक्रिया समय (औसत)
20.20s
कुल लागत
$0.400
रैंक
#99
कुल आउटपुट टोकन
63,667
प्रतिक्रिया समय (औसत)
27.82s
कुल लागत
$0.403
अनुशंसित मॉडल KAT-Coder-Pro V2.5 (low)

It has the strongest score in this comparison (7.3) and the best overall balance of cost and response time across all 2 models.

विस्तृत तुलना

मेट्रिक KAT-Coder-Pro V2.5 KAT-Coder-Pro V2.5 low रिलीज़: 2026-07-14 GLM 5.3 GLM 5.3 high रिलीज़: 2026-08-20
स्कोर 7.3 7.3
रैंक #100 #99
विश्वसनीयता 10.0 10.0
संगति 7.0 7.5
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 68.2% 74.2%
अस्थिर टेस्ट 8 7
कुल रन 66 66
प्रति परिणाम लागत 3.636 3.099
कुल लागत $0.400 $0.403
इनपुट कीमत $0.740 / 1M $1.400 / 1M
आउटपुट कीमत $2.960 / 1M $4.400 / 1M
कुल इनपुट टोकन 87,682 87,601
आउटपुट टोकन 7,166 6,006
रीजनिंग टोकन 106,027 57,661
प्रतिक्रिया समय (औसत) 20.20s 27.82s
प्रतिक्रिया समय (अधिकतम) 209.15s 159.91s
प्रतिक्रिया समय (कुल) 444.35s 612.06s
पैरामीटर ~700B कुल (~72B सक्रिय) 744B कुल (40B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#100 KAT-Coder-Pro V2.5

low
लागत
$0.016
समय
47.6s
टोकन
5,182 tok

#99 GLM 5.3

high
लागत
$0.085
समय
362.5s
टोकन
19,310 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
KAT-Coder-Pro V2.5 7.8 10.0 66.7% 0 24.87s 7,893 402 24,945
GLM 5.3 6.6 5.0 66.7% 2 18.89s 7,317 473 8,190

त्वरित तुलना

तुलना जोड़ी बदलें