नेव्हिगेशन
Advertise here

KAT-Coder-Pro V2.5 (low) vs GLM 5.2

GLM 5.2 average score मध्ये पुढे आहे: 6.6 vs 6.5. GLM 5.2 चा benchmark खर्च कमी आहे: $0.152 vs $0.400. GLM 5.2 वेगवान आहे: 11.27s vs 19.40s, pass rates 65.2% vs 63.8%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-01

तुलना केलेली मॉडेल्स

क्रमांक
#191
एकूण आउटपुट टोकन्स
113,193
प्रतिसाद वेळ (सरासरी)
19.40s
एकूण खर्च
$0.400
क्रमांक
#186
एकूण आउटपुट टोकन्स
17,685
प्रतिसाद वेळ (सरासरी)
11.27s
एकूण खर्च
$0.152
शिफारस केलेले मॉडेल GLM 5.2

It has the best score here (6.6), while costing about 2.6x less than KAT-Coder-Pro V2.5 (low).

तपशीलवार तुलना

मेट्रिक KAT-Coder-Pro V2.5 KAT-Coder-Pro V2.5 low प्रकाशन: 2026-07-14 GLM 5.2 GLM 5.2 none प्रकाशन: 2026-06-17
स्कोअर 6.5 6.6
क्रमांक #191 #186
विश्वसनीयता 10.0 10.0
सुसंगतता 7.1 9.0
प्रयत्न 69/69 69/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 65.2% 63.8%
अस्थिर चाचण्या 8 3
एकूण रन 69 69
प्रति निकाल खर्च 3.636 1.753
एकूण खर्च $0.400 $0.152
इनपुट किंमत $0.740 / 1M $0.325 / 1M
आउटपुट किंमत $2.960 / 1M $3.990 / 1M
एकूण इनपुट टोकन्स 87,682 247,919
आउटपुट टोकन्स 7,166 17,685
रिझनिंग टोकन्स 106,027 0
प्रतिसाद वेळ (सरासरी) 19.40s 11.27s
प्रतिसाद वेळ (कमाल) 209.15s 79.65s
प्रतिसाद वेळ (एकूण) 446.11s 259.32s
पॅरामीटर्स ~700B एकूण (~72B सक्रिय) 744B एकूण (40B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#191 KAT-Coder-Pro V2.5

low
खर्च
$0.016
वेळ
47.6s
टोकन्स
5,182 tok

#186 GLM 5.2

none
खर्च
$0.033
वेळ
87.7s
टोकन्स
7,455 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
KAT-Coder-Pro V2.5 7.8 10.0 66.7% 0 24.87s 7,893 402 24,945
GLM 5.2 3.7 9.5 0.0% 0 7.55s 7,263 1,958 0

झटपट तुलना

तुलना जोडी बदला