नेविगेशन
AI BENCHY
Advertise here

KAT-Coder-Pro V2.5 (low) vs GPT-5.5 (medium)

GPT-5.5 (medium) average score में आगे है: 9.0 vs 7.4. KAT-Coder-Pro V2.5 (low) की benchmark लागत कम है: $0.387 vs $4.137. KAT-Coder-Pro V2.5 (low) तेज है: 19.47s vs 38.42s, pass rates 69.7% vs 87.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

रैंक
#70
कुल आउटपुट टोकन
108,640
प्रतिक्रिया समय (औसत)
19.47s
कुल लागत
$0.387
रैंक
#15
कुल आउटपुट टोकन
124,436
प्रतिक्रिया समय (औसत)
38.42s
कुल लागत
$4.137
अनुशंसित मॉडल GPT-5.5 (medium)

It has the strongest score in this comparison (9.0) and the best overall balance of cost and response time across all 2 models.

विस्तृत तुलना

मेट्रिक KAT-Coder-Pro V2.5 KAT-Coder-Pro V2.5 low रिलीज़: 2026-07-14 GPT-5.5 GPT-5.5 medium रिलीज़: 2026-04-24
स्कोर 7.4 9.0
रैंक #70 #15
विश्वसनीयता 10.0 10.0
संगति 7.0 8.9
सही परीक्षण
प्रति प्रयास पास दर 69.7% 87.9%
अस्थिर टेस्ट 8 3
कुल रन 66 66
प्रति परिणाम लागत 3.514 22.980
कुल लागत $0.387 $4.137
इनपुट कीमत $0.740 / 1M $5.000 / 1M
आउटपुट कीमत $2.960 / 1M $30.000 / 1M
कुल इनपुट टोकन 87,673 80,659
आउटपुट टोकन 7,166 5,617
रीजनिंग टोकन 101,474 118,819
प्रतिक्रिया समय (औसत) 19.47s 38.42s
प्रतिक्रिया समय (अधिकतम) 209.15s 332.10s
प्रतिक्रिया समय (कुल) 428.31s 845.35s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#70 KAT-Coder-Pro V2.5

low
लागत
$0.016
समय
47.6s
टोकन
5,182 tok

#15 GPT-5.5

medium
लागत
$0.112
समय
71.9s
टोकन
3,807 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
KAT-Coder-Pro V2.5 7.8 10.0 66.7% 0 24.87s 7,893 402 24,945
GPT-5.5 8.8 7.8 88.9% 1 59.77s 7,305 362 24,959

त्वरित तुलना

तुलना जोड़ी बदलें