नेविगेशन
AI BENCHY
Advertise here

KAT-Coder-Pro V2.5 vs Qwen3.5-27B

KAT-Coder-Pro V2.5 average score में आगे है: 6.7 vs 6.6. Qwen3.5-27B की benchmark लागत कम है: $0.058 vs $0.487. Qwen3.5-27B तेज है: 4.77s vs 26.01s, pass rates 71.2% vs 45.5%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-20

रैंक
#139
कुल आउटपुट टोकन
139,572
प्रतिक्रिया समय (औसत)
26.01s
कुल लागत
$0.487
रैंक
#146
कुल आउटपुट टोकन
24,323
प्रतिक्रिया समय (औसत)
4.77s
कुल लागत
$0.058
अनुशंसित मॉडल Qwen3.5-27B

Its score stays close to the best score here (6.6 vs 6.7), while costing about 8.4x less than KAT-Coder-Pro V2.5.

विस्तृत तुलना

मेट्रिक KAT-Coder-Pro V2.5 KAT-Coder-Pro V2.5 none रिलीज़: 2026-07-14 Qwen3.5-27B Qwen3.5-27B none रिलीज़: 2026-02-24
स्कोर 6.7 6.6
रैंक #139 #146
विश्वसनीयता 10.0 10.0
संगति 7.0 9.3
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 71.2% 45.5%
अस्थिर टेस्ट 8 2
कुल रन 66 66
प्रति परिणाम लागत 4.419 0.678
कुल लागत $0.487 $0.058
इनपुट कीमत $0.740 / 1M $0.195 / 1M
आउटपुट कीमत $2.960 / 1M $1.560 / 1M
कुल इनपुट टोकन 98,508 102,325
आउटपुट टोकन 139,572 24,323
रीजनिंग टोकन 0 0
प्रतिक्रिया समय (औसत) 26.01s 4.77s
प्रतिक्रिया समय (अधिकतम) 335.41s 69.46s
प्रतिक्रिया समय (कुल) 572.22s 105.00s
पैरामीटर ~700B कुल (~72B सक्रिय) 27B
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#139 KAT-Coder-Pro V2.5

none
लागत
$0.010
समय
29.0s
टोकन
3,439 tok

#146 Qwen3.5-27B

none
लागत
$0.007
समय
42.9s
टोकन
4,273 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
KAT-Coder-Pro V2.5 6.1 4.7 66.7% 2 22.52s 7,893 22,440 0
Qwen3.5-27B 5.8 10.0 33.3% 0 1.80s 7,913 415 0

त्वरित तुलना

तुलना जोड़ी बदलें