नेविगेशन
AI BENCHY
Advertise here

KAT-Coder-Pro V2.5 (medium) vs GPT-5.6 Sol

GPT-5.6 Sol average score में आगे है: 7.0 vs 6.9. GPT-5.6 Sol की benchmark लागत कम है: $0.201 vs $0.478. GPT-5.6 Sol तेज है: 2.17s vs 24.87s, pass rates 65.2% vs 63.6%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-29

रैंक
#126
कुल आउटपुट टोकन
139,375
प्रतिक्रिया समय (औसत)
24.87s
कुल लागत
$0.478
रैंक
#118
कुल आउटपुट टोकन
4,357
प्रतिक्रिया समय (औसत)
2.17s
कुल लागत
$0.201
अनुशंसित मॉडल GPT-5.6 Sol

It has the best score here (7.0), while costing about 2.4x less than KAT-Coder-Pro V2.5 (medium).

विस्तृत तुलना

मेट्रिक KAT-Coder-Pro V2.5 KAT-Coder-Pro V2.5 medium रिलीज़: 2026-07-14 GPT-5.6 Sol GPT-5.6 Sol none रिलीज़: 2026-07-09
स्कोर 6.9 7.0
रैंक #126 #118
विश्वसनीयता 10.0 10.0
संगति 7.0 9.0
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 65.2% 63.6%
अस्थिर टेस्ट 8 3
कुल रन 66 66
प्रति परिणाम लागत 4.342 4.365
कुल लागत $0.478 $0.201
इनपुट कीमत $0.740 / 1M $2.000 / 1M
आउटपुट कीमत $2.960 / 1M $10.000 / 1M
कुल इनपुट टोकन 87,916 78,602
आउटपुट टोकन 7,213 4,357
रीजनिंग टोकन 132,162 0
प्रतिक्रिया समय (औसत) 24.87s 2.17s
प्रतिक्रिया समय (अधिकतम) 257.00s 12.81s
प्रतिक्रिया समय (कुल) 547.14s 47.66s
पैरामीटर ~700B कुल (~72B सक्रिय) ~2T कुल (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#126 KAT-Coder-Pro V2.5

medium
लागत
$0.009
समय
25.6s
टोकन
2,939 tok

#118 GPT-5.6 Sol

none
लागत
$0.116
समय
78.7s
टोकन
3,944 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
KAT-Coder-Pro V2.5 7.8 10.0 66.7% 0 33.10s 7,893 416 33,658
GPT-5.6 Sol 5.5 10.0 33.3% 0 1.39s 7,302 390 0

त्वरित तुलना

तुलना जोड़ी बदलें