नेविगेशन
Advertise here

KAT-Coder-Pro V2.5 (low) vs Grok 4.6 (low)

average score लगभग बराबर है: 7.3 vs 7.4. KAT-Coder-Pro V2.5 (low) की benchmark लागत कम है: $0.400 vs $0.449. Grok 4.6 (low) तेज है: 14.55s vs 20.20s, pass rates 68.2% vs 69.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-24

तुलना किए गए मॉडल

रैंक
#139
कुल आउटपुट टोकन
113,193
प्रतिक्रिया समय (औसत)
20.20s
कुल लागत
$0.400
रैंक
#135
कुल आउटपुट टोकन
38,048
प्रतिक्रिया समय (औसत)
14.55s
कुल लागत
$0.449
अनुशंसित मॉडल Grok 4.6 (low)

It has the strongest score in this comparison (7.4) and the best overall balance of cost and response time across all 2 models.

विस्तृत तुलना

मेट्रिक KAT-Coder-Pro V2.5 KAT-Coder-Pro V2.5 low रिलीज़: 2026-07-14 Grok 4.6 Grok 4.6 low रिलीज़: 2026-08-12
स्कोर 7.3 7.4
रैंक #139 #135
विश्वसनीयता 10.0 10.0
संगति 7.0 9.6
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 68.2% 69.7%
अस्थिर टेस्ट 8 1
कुल रन 66 66
प्रति परिणाम लागत 3.636 2.989
कुल लागत $0.400 $0.449
इनपुट कीमत $0.740 / 1M $2.000 / 1M
आउटपुट कीमत $2.960 / 1M $6.000 / 1M
कुल इनपुट टोकन 87,682 109,960
आउटपुट टोकन 7,166 5,124
रीजनिंग टोकन 106,027 32,924
प्रतिक्रिया समय (औसत) 20.20s 14.55s
प्रतिक्रिया समय (अधिकतम) 209.15s 26.46s
प्रतिक्रिया समय (कुल) 444.35s 320.17s
पैरामीटर ~700B कुल (~72B सक्रिय) ~1.7T कुल (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#139 KAT-Coder-Pro V2.5

low
लागत
$0.016
समय
47.6s
टोकन
5,182 tok

#135 SpaceXAI: Grok 4.6

low
लागत
$0.011
समय
26.0s
टोकन
1,941 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
KAT-Coder-Pro V2.5 7.8 10.0 66.7% 0 24.87s 7,893 402 24,945
Grok 4.6 5.5 7.1 44.4% 1 21.69s 9,579 349 7,740

त्वरित तुलना

तुलना जोड़ी बदलें