নেভিগেশন
AI BENCHY
Advertise here

Meituan: LongCat 2.0 vs Qwen: Qwen3.5-27B

LongCat 2.0 (high) average score-এ এগিয়ে: 6.6 vs 6.5. Qwen3.5-27B-এর benchmark খরচ কম: $0.090 vs $0.469. Qwen3.5-27B দ্রুত: 4.76s vs 148.73s, pass rates 53.0% vs 40.9%.

প্রস্তাবিত মডেলQwen3.5-27BIts score stays close to the best score here (6.5 vs 6.6), while costing about 5.2x less than LongCat 2.0 (high).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-20

মেট্রিক LongCat 2.0 LongCat 2.0 high প্রকাশ: 2026-07-20 Qwen3.5-27B Qwen3.5-27B none প্রকাশ: 2026-02-24
স্কোর 6.6 6.5
র‍্যাঙ্ক #97 #103
নির্ভরযোগ্যতা 9.4 10.0
ধারাবাহিকতা 8.2 9.3
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 53.0% 40.9%
অস্থির টেস্ট 5 2
মোট রান 66 66
প্রতি ফলাফলে খরচ 5.202 0.763
মোট খরচ $0.469 $0.090
ইনপুট মূল্য $0.300 / 1M $0.260 / 1M
আউটপুট মূল্য $1.200 / 1M $2.600 / 1M
মোট ইনপুট টোকেন 93,357 102,316
আউটপুট টোকেন 30,466 24,321
রিজনিং টোকেন 336,325 0
প্রতিক্রিয়া সময় (গড়) 148.73s 4.76s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 941.66s 69.46s
প্রতিক্রিয়া সময় (মোট) 3272.00s 104.71s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#97 LongCat 2.0

high
অবৈধ SVG
খরচ
$0.000
সময়
600.0s
টোকেন
0 tok

#103 Qwen3.5-27B

none
খরচ
$0.007
সময়
42.9s
টোকেন
4,273 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
LongCat 2.0 7.6 7.2 77.8% 1 505.33s 6,913 244 192,377
Qwen3.5-27B 5.8 10.0 33.3% 0 1.80s 7,913 415 0

দ্রুত তুলনা

তুলনার জুটি বদলান