नेविगेशन
Advertise here

KAT-Coder-Pro V2.5 (medium) vs GPT-6 Luna (low)

GPT-6 Luna (low) average score में आगे है: 7.0 vs 6.9. GPT-6 Luna (low) की benchmark लागत कम है: $0.020 vs $0.478. GPT-6 Luna (low) तेज है: 21.96s vs 24.87s, pass rates 65.2% vs 62.1%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-23

तुलना किए गए मॉडल

रैंक
#167
कुल आउटपुट टोकन
139,375
प्रतिक्रिया समय (औसत)
24.87s
कुल लागत
$0.478
रैंक
#159
कुल आउटपुट टोकन
22,605
प्रतिक्रिया समय (औसत)
21.96s
कुल लागत
$0.020
अनुशंसित मॉडल GPT-6 Luna (low)

It has the best score here (7.0), while costing about 24.7x less than KAT-Coder-Pro V2.5 (medium).

विस्तृत तुलना

मेट्रिक KAT-Coder-Pro V2.5 KAT-Coder-Pro V2.5 medium रिलीज़: 2026-07-14 GPT-6 Luna GPT-6 Luna low रिलीज़: 2026-09-23
स्कोर 6.9 7.0
रैंक #167 #159
विश्वसनीयता 10.0 9.6
संगति 7.0 8.5
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 65.2% 62.1%
अस्थिर टेस्ट 8 4
कुल रन 66 66
प्रति परिणाम लागत 4.342 0.176
कुल लागत $0.478 $0.020
इनपुट कीमत $0.740 / 1M $0.100 / 1M
आउटपुट कीमत $2.960 / 1M $0.500 / 1M
कुल इनपुट टोकन 87,916 80,159
आउटपुट टोकन 7,213 4,623
रीजनिंग टोकन 132,162 17,982
प्रतिक्रिया समय (औसत) 24.87s 21.96s
प्रतिक्रिया समय (अधिकतम) 257.00s 89.37s
प्रतिक्रिया समय (कुल) 547.14s 483.19s
पैरामीटर ~700B कुल (~72B सक्रिय) ~400B कुल (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#167 KAT-Coder-Pro V2.5

medium
लागत
$0.009
समय
25.6s
टोकन
2,939 tok

#159 GPT-6 Luna

low
लागत
$0.002
समय
19.2s
टोकन
2,598 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
KAT-Coder-Pro V2.5 7.8 10.0 66.7% 0 33.10s 7,893 416 33,658
GPT-6 Luna 6.0 7.2 55.6% 1 15.39s 7,302 493 6,655

त्वरित तुलना

तुलना जोड़ी बदलें