नेविगेशन
AI BENCHY
Advertise here

KAT-Coder-Air V2.5 (low) vs Qwen3.8 27B

Qwen3.8 27B average score में आगे है: 5.5 vs 5.4. स्थानीय हार्डवेयर की लागत नहीं मापी गई, इसलिए लागत की तुलना उपलब्ध नहीं है। Qwen3.8 27B तेज है: 3.12s vs 10.63s, pass rates 43.9% vs 40.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-15

रैंक
#215
कुल आउटपुट टोकन
60,414
प्रतिक्रिया समय (औसत)
10.63s
कुल लागत
$0.046
रैंक
#211
कुल आउटपुट टोकन
11,445
प्रतिक्रिया समय (औसत)
3.12s
कुल लागत
लागू नहीं
अनुशंसित मॉडल Qwen3.8 27B

It has the best score here (5.5), while responding about 3.4x faster than KAT-Coder-Air V2.5 (low).

विस्तृत तुलना

मेट्रिक KAT-Coder-Air V2.5 KAT-Coder-Air V2.5 low रिलीज़: 2026-07-14 Qwen3.8 27B Qwen3.8 27B none रिलीज़: 2026-08-14
स्कोर 5.4 5.5
रैंक #215 #211
विश्वसनीयता 9.9 10.0
संगति 7.8 10.0
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 43.9% 40.9%
अस्थिर टेस्ट 6 0
कुल रन 66 66
प्रति परिणाम लागत 0.649 लागू नहीं
कुल लागत $0.046 लागू नहीं
इनपुट कीमत $0.150 / 1M लागू नहीं
आउटपुट कीमत $0.600 / 1M लागू नहीं
कुल इनपुट टोकन 61,094 122,463
आउटपुट टोकन 6,532 11,445
रीजनिंग टोकन 53,882 0
प्रतिक्रिया समय (औसत) 10.63s 3.12s
प्रतिक्रिया समय (अधिकतम) 86.23s 44.76s
प्रतिक्रिया समय (कुल) 233.77s 68.69s
पैरामीटर ~35B कुल (~3B सक्रिय) 27.3B
उपलब्धता बंद स्रोत वेट उपलब्ध

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#215 KAT-Coder-Air V2.5

low
लागत
$0.004
समय
29.9s
टोकन
6,008 tok

#211 Qwen3.8 27B

none
लागत
लागू नहीं
समय
23.9s
टोकन
1,922 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
KAT-Coder-Air V2.5 3.5 7.3 11.1% 1 11.06s 7,893 2,001 13,623
Qwen3.8 27B 5.5 10.0 33.3% 0 1.19s 7,911 408 0

त्वरित तुलना

तुलना जोड़ी बदलें