नेविगेशन
Advertise here

KAT-Coder-Pro V2.5 (low) vs GLM 5.2

GLM 5.2 average score में आगे है: 6.6 vs 6.5. GLM 5.2 की benchmark लागत कम है: $0.152 vs $0.400. GLM 5.2 तेज है: 11.27s vs 19.40s, pass rates 65.2% vs 63.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#191
कुल आउटपुट टोकन
113,193
प्रतिक्रिया समय (औसत)
19.40s
कुल लागत
$0.400
रैंक
#186
कुल आउटपुट टोकन
17,685
प्रतिक्रिया समय (औसत)
11.27s
कुल लागत
$0.152
अनुशंसित मॉडल GLM 5.2

It has the best score here (6.6), while costing about 2.6x less than KAT-Coder-Pro V2.5 (low).

विस्तृत तुलना

मेट्रिक KAT-Coder-Pro V2.5 KAT-Coder-Pro V2.5 low रिलीज़: 2026-07-14 GLM 5.2 GLM 5.2 none रिलीज़: 2026-06-17
स्कोर 6.5 6.6
रैंक #191 #186
विश्वसनीयता 10.0 10.0
संगति 7.1 9.0
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 65.2% 63.8%
अस्थिर टेस्ट 8 3
कुल रन 69 69
प्रति परिणाम लागत 3.636 1.753
कुल लागत $0.400 $0.152
इनपुट कीमत $0.740 / 1M $0.325 / 1M
आउटपुट कीमत $2.960 / 1M $3.990 / 1M
कुल इनपुट टोकन 87,682 247,919
आउटपुट टोकन 7,166 17,685
रीजनिंग टोकन 106,027 0
प्रतिक्रिया समय (औसत) 19.40s 11.27s
प्रतिक्रिया समय (अधिकतम) 209.15s 79.65s
प्रतिक्रिया समय (कुल) 446.11s 259.32s
पैरामीटर ~700B कुल (~72B सक्रिय) 744B कुल (40B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#191 KAT-Coder-Pro V2.5

low
लागत
$0.016
समय
47.6s
टोकन
5,182 tok

#186 GLM 5.2

none
लागत
$0.033
समय
87.7s
टोकन
7,455 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
KAT-Coder-Pro V2.5 7.8 10.0 66.7% 0 24.87s 7,893 402 24,945
GLM 5.2 3.7 9.5 0.0% 0 7.55s 7,263 1,958 0

त्वरित तुलना

तुलना जोड़ी बदलें