নেভিগেশন
AI BENCHY
Advertise here

Kwaipilot: KAT-Coder-Pro V2.5 vs Meituan: LongCat 2.0

LongCat 2.0 (medium) average score-এ এগিয়ে: 7.4 vs 7.2. LongCat 2.0 (medium)-এর benchmark খরচ কম: $0.478 vs $0.482. KAT-Coder-Pro V2.5 (high) দ্রুত: 20.83s vs 136.64s, pass rates 63.6% vs 60.6%.

প্রস্তাবিত মডেলKAT-Coder-Pro V2.5 (high)Its score stays close to the best score here (7.2 vs 7.4), while responding about 6.6x faster than LongCat 2.0 (medium).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-20

মেট্রিক KAT-Coder-Pro V2.5 KAT-Coder-Pro V2.5 high প্রকাশ: 2026-07-14 LongCat 2.0 LongCat 2.0 medium প্রকাশ: 2026-07-20
স্কোর 7.2 7.4
র‍্যাঙ্ক #69 #60
নির্ভরযোগ্যতা 10.0 9.8
ধারাবাহিকতা 7.8 8.9
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 63.6% 60.6%
অস্থির টেস্ট 6 3
মোট রান 66 66
প্রতি ফলাফলে খরচ 4.378 3.978
মোট খরচ $0.482 $0.478
ইনপুট মূল্য $0.740 / 1M $0.300 / 1M
আউটপুট মূল্য $2.960 / 1M $1.200 / 1M
মোট ইনপুট টোকেন 106,076 97,315
আউটপুট টোকেন 9,071 44,384
রিজনিং টোকেন 127,093 329,012
প্রতিক্রিয়া সময় (গড়) 20.83s 136.64s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 199.97s 939.52s
প্রতিক্রিয়া সময় (মোট) 458.31s 3006.01s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#69 KAT-Coder-Pro V2.5

high
খরচ
$0.009
সময়
26.4s
টোকেন
3,117 tok

#60 LongCat 2.0

medium
খরচ
$0.016
সময়
285.1s
টোকেন
13,057 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
KAT-Coder-Pro V2.5 6.4 7.9 44.4% 1 22.00s 7,893 422 20,461
LongCat 2.0 10.0 10.0 100.0% 0 455.00s 7,419 533 214,143

দ্রুত তুলনা

তুলনার জুটি বদলান