নেভিগেশন
AI BENCHY
Advertise here

LongCat 2.0 (medium) vs Qwen3.7 Flash (low)

LongCat 2.0 (medium) average score-এ এগিয়ে: 7.4 vs 7.3. Qwen3.7 Flash (low)-এর benchmark খরচ কম: $0.042 vs $0.478. Qwen3.7 Flash (low) দ্রুত: 36.80s vs 136.64s, pass rates 60.6% vs 68.2%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-28

র‍্যাঙ্ক
#69
মোট আউটপুট টোকেন
373,396
প্রতিক্রিয়া সময় (গড়)
136.64s
মোট খরচ
$0.478
র‍্যাঙ্ক
#75
মোট আউটপুট টোকেন
297,249
প্রতিক্রিয়া সময় (গড়)
36.80s
মোট খরচ
$0.042
প্রস্তাবিত মডেল Qwen3.7 Flash (low)

Its score stays close to the best score here (7.3 vs 7.4), while costing about 11.5x less than LongCat 2.0 (medium).

বিস্তারিত তুলনা

মেট্রিক LongCat 2.0 LongCat 2.0 medium প্রকাশ: 2026-07-20 Qwen3.7 Flash Qwen3.7 Flash low প্রকাশ: 2026-07-28
স্কোর 7.4 7.3
র‍্যাঙ্ক #69 #75
নির্ভরযোগ্যতা 9.8 9.9
ধারাবাহিকতা 8.9 8.4
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 60.6% 68.2%
অস্থির টেস্ট 3 5
মোট রান 66 66
প্রতি ফলাফলে খরচ 3.978 0.346
মোট খরচ $0.478 $0.042
ইনপুট মূল্য $0.300 / 1M $0.030 / 1M
আউটপুট মূল্য $1.200 / 1M $0.130 / 1M
মোট ইনপুট টোকেন 97,315 92,182
আউটপুট টোকেন 44,384 14,287
রিজনিং টোকেন 329,012 282,962
প্রতিক্রিয়া সময় (গড়) 136.64s 36.80s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 939.52s 394.54s
প্রতিক্রিয়া সময় (মোট) 3006.01s 809.54s

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#69 LongCat 2.0

medium
খরচ
$0.016
সময়
285.1s
টোকেন
13,057 tok

#75 Qwen3.7 Flash

low
অবৈধ SVG
খরচ
$0.000
সময়
600.0s
টোকেন
0 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
LongCat 2.0 10.0 10.0 100.0% 0 455.00s 7,419 533 214,143
Qwen3.7 Flash 6.7 7.8 55.6% 1 42.36s 7,893 428 56,419

দ্রুত তুলনা

তুলনার জুটি বদলান