नेविगेशन
Advertise here

KAT-Coder-Air V2.5 (medium) vs Qwen3.8 27B

average score लगभग बराबर है: 5.6 vs 5.5. Qwen3.8 27B की benchmark लागत कम है: ~$0.006 vs $0.048. Qwen3.8 27B तेज है: 3.12s vs 8.65s, pass rates 45.5% vs 40.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-28

तुलना किए गए मॉडल

रैंक
#272
कुल आउटपुट टोकन
66,576
प्रतिक्रिया समय (औसत)
8.65s
कुल लागत
$0.048
रैंक
#277
कुल आउटपुट टोकन
11,445
प्रतिक्रिया समय (औसत)
3.12s
कुल लागत
~$0.006
अनुशंसित मॉडल Qwen3.8 27B

It has the best score here (5.5), while costing about 8.4x less than KAT-Coder-Air V2.5 (medium).

विस्तृत तुलना

मेट्रिक KAT-Coder-Air V2.5 KAT-Coder-Air V2.5 medium रिलीज़: 2026-07-14 Qwen3.8 27B Qwen3.8 27B none रिलीज़: 2026-08-14
स्कोर 5.6 5.5
रैंक #272 #277
विश्वसनीयता 9.6 10.0
संगति 8.9 10.0
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 45.5% 40.9%
अस्थिर टेस्ट 3 0
कुल रन 66 66
प्रति परिणाम लागत 0.596 ~0.063
कुल लागत $0.048 ~$0.006
इनपुट कीमत $0.150 / 1M लागू नहीं
आउटपुट कीमत $0.600 / 1M लागू नहीं
कुल इनपुट टोकन 51,369 122,463
आउटपुट टोकन 8,008 11,445
रीजनिंग टोकन 58,568 0
प्रतिक्रिया समय (औसत) 8.65s 3.12s
प्रतिक्रिया समय (अधिकतम) 48.19s 44.76s
प्रतिक्रिया समय (कुल) 190.35s 68.69s
पैरामीटर ~35B कुल (~3B सक्रिय) 27.3B
उपलब्धता बंद स्रोत वेट उपलब्ध

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#272 KAT-Coder-Air V2.5

medium
लागत
$0.003
समय
23.7s
टोकन
4,924 tok

#277 Qwen3.8 27B

none
लागत
~$0.001
समय
23.9s
टोकन
1,922 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
KAT-Coder-Air V2.5 3.6 7.0 22.2% 1 23.37s 7,893 5,199 29,973
Qwen3.8 27B 5.5 10.0 33.3% 0 1.19s 7,911 408 0

त्वरित तुलना

तुलना जोड़ी बदलें