नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Kwaipilot: KAT-Coder-Pro V2.5 vs Z.ai: GLM 5.2

KAT-Coder-Pro V2.5 average score मध्ये पुढे आहे: 6.7 vs 6.6. GLM 5.2 चा benchmark खर्च कमी आहे: $0.125 vs $0.476. GLM 5.2 वेगवान आहे: 9.34s vs 25.56s, pass rates 68.2% vs 59.1%.

शिफारस केलेले मॉडेलGLM 5.2Its score stays close to the best score here (6.6 vs 6.7), while costing about 3.8x less than KAT-Coder-Pro V2.5.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-25

मेट्रिक KAT-Coder-Pro V2.5 KAT-Coder-Pro V2.5 none प्रकाशन: 2026-07-14 GLM 5.2 GLM 5.2 none प्रकाशन: 2026-06-17
स्कोअर 6.7 6.6
क्रमांक #101 #105
विश्वसनीयता 10.0 10.0
सुसंगतता 7.4 9.2
बरोबर चाचण्या
प्रति प्रयत्न पास दर 68.2% 59.1%
अस्थिर चाचण्या 7 2
एकूण रन 66 64
प्रति निकाल खर्च 4.319 1.421
एकूण खर्च $0.476 $0.125
इनपुट किंमत $0.740 / 1M $0.793 / 1M
आउटपुट किंमत $2.960 / 1M $2.491 / 1M
एकूण इनपुट टोकन्स 98,499 112,359
आउटपुट टोकन्स 135,861 14,340
रिझनिंग टोकन्स 0 0
प्रतिसाद वेळ (सरासरी) 25.56s 9.34s
प्रतिसाद वेळ (कमाल) 335.41s 79.65s
प्रतिसाद वेळ (एकूण) 562.43s 205.46s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#101 KAT-Coder-Pro V2.5

none
खर्च
$0.010
वेळ
29.0s
टोकन्स
3,439 tok

#105 GLM 5.2

none
अवैध SVG
खर्च
$0.033
वेळ
87.7s
टोकन्स
7,455 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
KAT-Coder-Pro V2.5 6.1 4.7 66.7% 2 22.52s 7,893 22,440 0
GLM 5.2 3.7 9.5 0.0% 0 7.55s 7,263 1,958 0

झटपट तुलना

तुलना जोडी बदला