नेविगेशन
Advertise here

KAT Coder AIR V2.5 (low) vs GPT-4o-mini

average score लगभग बराबर है: 5.0 vs 5.0. GPT-4o-mini की benchmark लागत कम है: $0.024 vs $0.046. GPT-4o-mini तेज है: 4.16s vs 10.21s, pass rates 42.0% vs 21.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#301
कुल आउटपुट टोकन
60,414
प्रतिक्रिया समय (औसत)
10.21s
कुल लागत
$0.046
रैंक
#300
कुल आउटपुट टोकन
3,627
प्रतिक्रिया समय (औसत)
4.16s
कुल लागत
$0.024
अनुशंसित मॉडल GPT-4o-mini

It has the best score here (5.0), while costing about 1.9x less than KAT Coder AIR V2.5 (low).

विस्तृत तुलना

मेट्रिक KAT Coder AIR V2.5 KAT Coder AIR V2.5 low रिलीज़: 2026-07-14 GPT-4o-mini GPT-4o-mini none रिलीज़: 2024-07-18
स्कोर 5.0 5.0
रैंक #301 #300
विश्वसनीयता 9.9 10.0
संगति 7.8 9.9
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 42.0% 21.7%
अस्थिर टेस्ट 6 0
कुल रन 69 69
प्रति परिणाम लागत 0.649 0.480
कुल लागत $0.046 $0.024
इनपुट कीमत $0.000 / 1M $0.150 / 1M
आउटपुट कीमत $0.000 / 1M $0.600 / 1M
कुल इनपुट टोकन 61,094 145,180
आउटपुट टोकन 6,532 3,627
रीजनिंग टोकन 53,882 0
प्रतिक्रिया समय (औसत) 10.21s 4.16s
प्रतिक्रिया समय (अधिकतम) 86.23s 39.99s
प्रतिक्रिया समय (कुल) 234.86s 70.70s
पैरामीटर ~35B कुल (~3B सक्रिय) ~8B
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#301 KAT Coder AIR V2.5

low
लागत
$0.004
समय
29.9s
टोकन
6,008 tok

#300 GPT-4o-mini

none
लागत
$0.001
समय
6.6s
टोकन
742 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
KAT Coder AIR V2.5 3.5 7.3 11.1% 1 11.06s 7,893 2,001 13,623
GPT-4o-mini 3.2 9.6 0.0% 0 1.63s 7,314 367 0

त्वरित तुलना

तुलना जोड़ी बदलें