নেভিগেশন
Advertise here

KAT-Coder-Air V2.5 (medium) vs GPT-6 Luna

average score প্রায় সমান: 5.6 vs 5.6. GPT-6 Luna-এর benchmark খরচ কম: $0.012 vs $0.048. KAT-Coder-Air V2.5 (medium) দ্রুত: 8.65s vs 19.08s, pass rates 45.5% vs 42.4%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-09-23

তুলনা করা মডেল

র‍্যাঙ্ক
#264
মোট আউটপুট টোকেন
66,576
প্রতিক্রিয়া সময় (গড়)
8.65s
মোট খরচ
$0.048
র‍্যাঙ্ক
#260
মোট আউটপুট টোকেন
5,508
প্রতিক্রিয়া সময় (গড়)
19.08s
মোট খরচ
$0.012
প্রস্তাবিত মডেল KAT-Coder-Air V2.5 (medium)

It has the best score here (5.6), while responding about 2.2x faster than GPT-6 Luna.

বিস্তারিত তুলনা

মেট্রিক KAT-Coder-Air V2.5 KAT-Coder-Air V2.5 medium প্রকাশ: 2026-07-14 GPT-6 Luna GPT-6 Luna none প্রকাশ: 2026-09-23
স্কোর 5.6 5.6
র‍্যাঙ্ক #264 #260
নির্ভরযোগ্যতা 9.6 9.9
ধারাবাহিকতা 8.9 8.1
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 45.5% 42.4%
অস্থির টেস্ট 3 5
মোট রান 66 66
প্রতি ফলাফলে খরচ 0.596 0.164
মোট খরচ $0.048 $0.012
ইনপুট মূল্য $0.150 / 1M $0.100 / 1M
আউটপুট মূল্য $0.600 / 1M $0.500 / 1M
মোট ইনপুট টোকেন 51,369 87,216
আউটপুট টোকেন 8,008 5,508
রিজনিং টোকেন 58,568 0
প্রতিক্রিয়া সময় (গড়) 8.65s 19.08s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 48.19s 98.62s
প্রতিক্রিয়া সময় (মোট) 190.35s 419.83s
প্যারামিটার ~35B মোট (~3B সক্রিয়) ~400B মোট (~17B সক্রিয়)
উপলভ্যতা বন্ধ উৎস বন্ধ উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#264 KAT-Coder-Air V2.5

medium
খরচ
$0.003
সময়
23.7s
টোকেন
4,924 tok

#260 GPT-6 Luna

none
খরচ
$0.002
সময়
26.0s
টোকেন
3,235 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
KAT-Coder-Air V2.5 3.6 7.0 22.2% 1 23.37s 7,893 5,199 29,973
GPT-6 Luna 5.5 10.0 33.3% 0 8.04s 7,302 376 0

দ্রুত তুলনা

তুলনার জুটি বদলান