নেভিগেশন
AI BENCHY
Advertise here

KAT-Coder-Pro V2.5 vs GLM 5.3 (low)

average score প্রায় সমান: 6.7 vs 6.8. GLM 5.3 (low)-এর benchmark খরচ কম: $0.257 vs $0.487. GLM 5.3 (low) দ্রুত: 13.65s vs 26.01s, pass rates 71.2% vs 65.2%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-08-20

র‍্যাঙ্ক
#139
মোট আউটপুট টোকেন
139,572
প্রতিক্রিয়া সময় (গড়)
26.01s
মোট খরচ
$0.487
র‍্যাঙ্ক
#134
মোট আউটপুট টোকেন
24,808
প্রতিক্রিয়া সময় (গড়)
13.65s
মোট খরচ
$0.257
প্রস্তাবিত মডেল GLM 5.3 (low)

It has the best score here (6.8), while costing about 1.9x less than KAT-Coder-Pro V2.5.

বিস্তারিত তুলনা

মেট্রিক KAT-Coder-Pro V2.5 KAT-Coder-Pro V2.5 none প্রকাশ: 2026-07-14 GLM 5.3 GLM 5.3 low প্রকাশ: 2026-08-20
স্কোর 6.7 6.8
র‍্যাঙ্ক #139 #134
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 7.0 8.5
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 71.2% 65.2%
অস্থির টেস্ট 8 4
মোট রান 66 66
প্রতি ফলাফলে খরচ 4.419 2.135
মোট খরচ $0.487 $0.257
ইনপুট মূল্য $0.740 / 1M $1.400 / 1M
আউটপুট মূল্য $2.960 / 1M $4.400 / 1M
মোট ইনপুট টোকেন 98,508 104,989
আউটপুট টোকেন 139,572 8,532
রিজনিং টোকেন 0 16,276
প্রতিক্রিয়া সময় (গড়) 26.01s 13.65s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 335.41s 83.60s
প্রতিক্রিয়া সময় (মোট) 572.22s 300.22s
প্যারামিটার ~700B মোট (~72B সক্রিয়) 744B মোট (40B সক্রিয়)
উপলভ্যতা বন্ধ উৎস বন্ধ উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#139 KAT-Coder-Pro V2.5

none
খরচ
$0.010
সময়
29.0s
টোকেন
3,439 tok

#134 GLM 5.3

low
খরচ
$0.007
সময়
28.4s
টোকেন
1,599 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
KAT-Coder-Pro V2.5 6.1 4.7 66.7% 2 22.52s 7,893 22,440 0
GLM 5.3 6.2 6.9 55.6% 1 21.02s 7,317 368 6,764

দ্রুত তুলনা

তুলনার জুটি বদলান