নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Kwaipilot: KAT-Coder-Pro V2.5 vs Meituan: LongCat 2.0

average score প্রায় সমান: 6.7 vs 6.7. LongCat 2.0 (low)-এর benchmark খরচ কম: $0.391 vs $0.476. KAT-Coder-Pro V2.5 দ্রুত: 25.56s vs 100.31s, pass rates 68.2% vs 53.0%.

প্রস্তাবিত মডেলKAT-Coder-Pro V2.5It has the best score here (6.7), while responding about 3.9x faster than LongCat 2.0 (low).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-20

মেট্রিক KAT-Coder-Pro V2.5 KAT-Coder-Pro V2.5 none প্রকাশ: 2026-07-14 LongCat 2.0 LongCat 2.0 low প্রকাশ: 2026-07-20
স্কোর 6.7 6.7
র‍্যাঙ্ক #92 #91
নির্ভরযোগ্যতা 10.0 9.6
ধারাবাহিকতা 7.4 8.9
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 68.2% 53.0%
অস্থির টেস্ট 7 3
মোট রান 66 66
প্রতি ফলাফলে খরচ 4.319 3.910
মোট খরচ $0.476 $0.391
ইনপুট মূল্য $0.740 / 1M $0.300 / 1M
আউটপুট মূল্য $2.960 / 1M $1.200 / 1M
মোট ইনপুট টোকেন 98,499 90,909
আউটপুট টোকেন 135,861 5,679
রিজনিং টোকেন 0 297,369
প্রতিক্রিয়া সময় (গড়) 25.56s 100.31s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 335.41s 560.39s
প্রতিক্রিয়া সময় (মোট) 562.43s 2206.82s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#92 KAT-Coder-Pro V2.5

none
খরচ
$0.010
সময়
29.0s
টোকেন
3,439 tok

#91 LongCat 2.0

low
খরচ
$0.024
সময়
428.0s
টোকেন
19,557 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
KAT-Coder-Pro V2.5 6.1 4.7 66.7% 2 22.52s 7,893 22,440 0
LongCat 2.0 6.6 4.6 77.8% 2 479.30s 6,544 461 206,627

দ্রুত তুলনা

তুলনার জুটি বদলান