নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Kwaipilot: KAT-Coder-Pro V2.5 vs Meituan: LongCat 2.0

average score প্রায় সমান: 7.4 vs 7.4. KAT-Coder-Pro V2.5 (low)-এর benchmark খরচ কম: $0.387 vs $0.478. KAT-Coder-Pro V2.5 (low) দ্রুত: 19.47s vs 136.64s, pass rates 69.7% vs 60.6%.

প্রস্তাবিত মডেলKAT-Coder-Pro V2.5 (low)It has the best score here (7.4), while responding about 7.0x faster than LongCat 2.0 (medium).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-20

মেট্রিক KAT-Coder-Pro V2.5 KAT-Coder-Pro V2.5 low প্রকাশ: 2026-07-14 LongCat 2.0 LongCat 2.0 medium প্রকাশ: 2026-07-20
স্কোর 7.4 7.4
র‍্যাঙ্ক #62 #60
নির্ভরযোগ্যতা 10.0 9.8
ধারাবাহিকতা 7.0 8.9
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 69.7% 60.6%
অস্থির টেস্ট 8 3
মোট রান 66 66
প্রতি ফলাফলে খরচ 3.514 3.978
মোট খরচ $0.387 $0.478
ইনপুট মূল্য $0.740 / 1M $0.300 / 1M
আউটপুট মূল্য $2.960 / 1M $1.200 / 1M
মোট ইনপুট টোকেন 87,673 97,315
আউটপুট টোকেন 7,166 44,384
রিজনিং টোকেন 101,474 329,012
প্রতিক্রিয়া সময় (গড়) 19.47s 136.64s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 209.15s 939.52s
প্রতিক্রিয়া সময় (মোট) 428.31s 3006.01s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#62 KAT-Coder-Pro V2.5

low
খরচ
$0.016
সময়
47.6s
টোকেন
5,182 tok

#60 LongCat 2.0

medium
খরচ
$0.016
সময়
285.1s
টোকেন
13,057 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
KAT-Coder-Pro V2.5 7.8 10.0 66.7% 0 24.87s 7,893 402 24,945
LongCat 2.0 10.0 10.0 100.0% 0 455.00s 7,419 533 214,143

দ্রুত তুলনা

তুলনার জুটি বদলান