नेव्हिगेशन
Advertise here

KAT-Coder-Pro V2.5 vs GLM 5.2

average score जवळपास समान आहे: 6.7 vs 6.7. GLM 5.2 चा benchmark खर्च कमी आहे: $0.153 vs $0.487. GLM 5.2 वेगवान आहे: 9.65s vs 26.01s, pass rates 71.2% vs 63.6%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-09-10

तुलना केलेली मॉडेल्स

क्रमांक
#165
एकूण आउटपुट टोकन्स
139,572
प्रतिसाद वेळ (सरासरी)
26.01s
एकूण खर्च
$0.487
क्रमांक
#164
एकूण आउटपुट टोकन्स
14,344
प्रतिसाद वेळ (सरासरी)
9.65s
एकूण खर्च
$0.153
शिफारस केलेले मॉडेल GLM 5.2

It has the best score here (6.7), while costing about 3.2x less than KAT-Coder-Pro V2.5.

तपशीलवार तुलना

मेट्रिक KAT-Coder-Pro V2.5 KAT-Coder-Pro V2.5 none प्रकाशन: 2026-07-14 GLM 5.2 GLM 5.2 none प्रकाशन: 2026-06-17
स्कोअर 6.7 6.7
क्रमांक #165 #164
विश्वसनीयता 10.0 10.0
सुसंगतता 7.0 9.2
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 71.2% 63.6%
अस्थिर चाचण्या 8 2
एकूण रन 66 66
प्रति निकाल खर्च 4.419 1.312
एकूण खर्च $0.487 $0.153
इनपुट किंमत $0.740 / 1M $0.966 / 1M
आउटपुट किंमत $2.960 / 1M $3.036 / 1M
एकूण इनपुट टोकन्स 98,508 112,458
आउटपुट टोकन्स 139,572 14,344
रिझनिंग टोकन्स 0 0
प्रतिसाद वेळ (सरासरी) 26.01s 9.65s
प्रतिसाद वेळ (कमाल) 335.41s 79.65s
प्रतिसाद वेळ (एकूण) 572.22s 212.38s
पॅरामीटर्स ~700B एकूण (~72B सक्रिय) 744B एकूण (40B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#165 KAT-Coder-Pro V2.5

none
खर्च
$0.010
वेळ
29.0s
टोकन्स
3,439 tok

#164 GLM 5.2

none
खर्च
$0.033
वेळ
87.7s
टोकन्स
7,455 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
KAT-Coder-Pro V2.5 6.1 4.7 66.7% 2 22.52s 7,893 22,440 0
GLM 5.2 3.7 9.5 0.0% 0 7.55s 7,263 1,958 0

झटपट तुलना

तुलना जोडी बदला