নেভিগেশন
AI BENCHY
Advertise here

Meituan: LongCat 2.0 vs Meituan: LongCat 2.0

LongCat 2.0 (low) average score-এ এগিয়ে: 6.7 vs 6.6. LongCat 2.0 (low)-এর benchmark খরচ কম: $0.391 vs $0.469. LongCat 2.0 (low) দ্রুত: 100.31s vs 148.73s, pass rates 53.0% vs 53.0%.

প্রস্তাবিত মডেলLongCat 2.0 (low)It has the strongest score in this comparison (6.7) and the best overall balance of cost and response time across all 2 models.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-20

মেট্রিক LongCat 2.0 LongCat 2.0 high প্রকাশ: 2026-07-20 LongCat 2.0 LongCat 2.0 low প্রকাশ: 2026-07-20
স্কোর 6.6 6.7
র‍্যাঙ্ক #97 #91
নির্ভরযোগ্যতা 9.4 9.6
ধারাবাহিকতা 8.2 8.9
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 53.0% 53.0%
অস্থির টেস্ট 5 3
মোট রান 66 66
প্রতি ফলাফলে খরচ 5.202 3.910
মোট খরচ $0.469 $0.391
ইনপুট মূল্য $0.300 / 1M $0.300 / 1M
আউটপুট মূল্য $1.200 / 1M $1.200 / 1M
মোট ইনপুট টোকেন 93,357 90,909
আউটপুট টোকেন 30,466 5,679
রিজনিং টোকেন 336,325 297,369
প্রতিক্রিয়া সময় (গড়) 148.73s 100.31s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 941.66s 560.39s
প্রতিক্রিয়া সময় (মোট) 3272.00s 2206.82s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#97 LongCat 2.0

high
অবৈধ SVG
খরচ
$0.000
সময়
600.0s
টোকেন
0 tok

#91 LongCat 2.0

low
খরচ
$0.024
সময়
428.0s
টোকেন
19,557 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
LongCat 2.0 7.6 7.2 77.8% 1 505.33s 6,913 244 192,377
LongCat 2.0 6.6 4.6 77.8% 2 479.30s 6,544 461 206,627

দ্রুত তুলনা

তুলনার জুটি বদলান