नेविगेशन
AI BENCHY
Advertise here

KAT-Coder-Air V2.5 (low) vs Laguna S 2.1 (high)

average score लगभग बराबर है: 5.4 vs 5.4. KAT-Coder-Air V2.5 (low) की benchmark लागत कम है: $0.046 vs $0.114. KAT-Coder-Air V2.5 (low) तेज है: 10.63s vs 111.60s, pass rates 43.9% vs 27.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-04

रैंक
#240
कुल आउटपुट टोकन
60,414
प्रतिक्रिया समय (औसत)
10.63s
कुल लागत
$0.046
रैंक
#245
कुल आउटपुट टोकन
584,864
प्रतिक्रिया समय (औसत)
111.60s
कुल लागत
$0.114
अनुशंसित मॉडल KAT-Coder-Air V2.5 (low)

It has the best score here (5.4), while costing about 2.5x less than Laguna S 2.1 (high).

विस्तृत तुलना

मेट्रिक KAT-Coder-Air V2.5 KAT-Coder-Air V2.5 low रिलीज़: 2026-07-14 Laguna S 2.1 Laguna S 2.1 high रिलीज़: 2026-07-21 निःशुल्क उपलब्ध
स्कोर 5.4 5.4
रैंक #240 #245
विश्वसनीयता 9.9 10.0
संगति 7.8 8.1
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 43.9% 27.3%
अस्थिर टेस्ट 6 5
कुल रन 66 66
प्रति परिणाम लागत 0.649 3.153
कुल लागत $0.046 $0.114
इनपुट कीमत $0.150 / 1M $0.090 / 1M
आउटपुट कीमत $0.600 / 1M $0.180 / 1M
कुल इनपुट टोकन 61,094 208,937
आउटपुट टोकन 6,532 175,588
रीजनिंग टोकन 53,882 409,276
प्रतिक्रिया समय (औसत) 10.63s 111.60s
प्रतिक्रिया समय (अधिकतम) 86.23s 1190.11s
प्रतिक्रिया समय (कुल) 233.77s 2455.24s
पैरामीटर ~35B कुल (~3B सक्रिय) 118B कुल (8B सक्रिय)
उपलब्धता बंद स्रोत वेट उपलब्ध

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#240 KAT-Coder-Air V2.5

low
लागत
$0.004
समय
29.9s
टोकन
6,008 tok

#245 Laguna S 2.1

high
लागत
$0.001
समय
6.8s
टोकन
1,389 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
KAT-Coder-Air V2.5 3.5 7.3 11.1% 1 11.06s 7,893 2,001 13,623
Laguna S 2.1 5.3 7.2 44.4% 1 271.42s 6,496 59,355 151,009

त्वरित तुलना

तुलना जोड़ी बदलें