নেভিগেশন
AI BENCHY
Advertise here

LongCat 2.0 vs Qwen3.6 27B (medium)

Qwen3.6 27B (medium) average score-এ এগিয়ে: 6.5 vs 6.4. LongCat 2.0-এর benchmark খরচ কম: $0.044 vs $1.045. LongCat 2.0 দ্রুত: 5.17s vs 106.06s, pass rates 40.9% vs 60.6%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-08-15

র‍্যাঙ্ক
#157
মোট আউটপুট টোকেন
9,375
প্রতিক্রিয়া সময় (গড়)
5.17s
মোট খরচ
$0.044
র‍্যাঙ্ক
#150
মোট আউটপুট টোকেন
272,573
প্রতিক্রিয়া সময় (গড়)
106.06s
মোট খরচ
$1.045
প্রস্তাবিত মডেল LongCat 2.0

Its score stays close to the best score here (6.4 vs 6.5), while costing about 23.8x less than Qwen3.6 27B (medium).

বিস্তারিত তুলনা

মেট্রিক LongCat 2.0 LongCat 2.0 none প্রকাশ: 2026-07-20 Qwen3.6 27B Qwen3.6 27B medium প্রকাশ: 2026-04-20
স্কোর 6.4 6.5
র‍্যাঙ্ক #157 #150
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.3 7.6
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 40.9% 60.6%
অস্থির টেস্ট 2 7
মোট রান 66 66
প্রতি ফলাফলে খরচ 0.549 7.448
মোট খরচ $0.044 $1.045
ইনপুট মূল্য $0.300 / 1M $0.600 / 1M
আউটপুট মূল্য $1.200 / 1M $3.600 / 1M
মোট ইনপুট টোকেন 108,752 106,176
আউটপুট টোকেন 9,375 33,013
রিজনিং টোকেন 0 239,560
প্রতিক্রিয়া সময় (গড়) 5.17s 106.06s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 48.38s 1085.11s
প্রতিক্রিয়া সময় (মোট) 113.83s 2333.36s
প্যারামিটার 1.6T মোট (48B সক্রিয়) 27B
উপলভ্যতা উন্মুক্ত উৎস উন্মুক্ত উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#157 LongCat 2.0

none
খরচ
$0.027
সময়
411.7s
টোকেন
22,283 tok

#150 Qwen3.6 27B

medium
খরচ
$0.009
সময়
39.6s
টোকেন
3,090 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
LongCat 2.0 5.5 10.0 33.3% 0 2.85s 7,446 578 0
Qwen3.6 27B 7.7 10.0 66.7% 0 142.99s 5,051 7,968 43,367

দ্রুত তুলনা

তুলনার জুটি বদলান