নেভিগেশন
AI BENCHY
Advertise here

Meituan: LongCat 2.0 vs Qwen: Qwen3.6 35B A3B

average score প্রায় সমান: 6.7 vs 6.7. LongCat 2.0 (low)-এর benchmark খরচ কম: $0.391 vs $0.746. Qwen3.6 35B A3B (medium) দ্রুত: 58.06s vs 100.31s, pass rates 53.0% vs 60.6%.

প্রস্তাবিত মডেলLongCat 2.0 (low)It has the best score here (6.7), while costing about 1.9x less than Qwen3.6 35B A3B (medium).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-20

মেট্রিক LongCat 2.0 LongCat 2.0 low প্রকাশ: 2026-07-20 Qwen3.6 35B A3B Qwen3.6 35B A3B medium প্রকাশ: 2026-04-20
স্কোর 6.7 6.7
র‍্যাঙ্ক #91 #90
নির্ভরযোগ্যতা 9.6 10.0
ধারাবাহিকতা 8.9 9.6
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 53.0% 60.6%
অস্থির টেস্ট 3 1
মোট রান 66 66
প্রতি ফলাফলে খরচ 3.910 5.712
মোট খরচ $0.391 $0.746
ইনপুট মূল্য $0.300 / 1M $0.140 / 1M
আউটপুট মূল্য $1.200 / 1M $1.000 / 1M
মোট ইনপুট টোকেন 90,909 85,139
আউটপুট টোকেন 5,679 61,819
রিজনিং টোকেন 297,369 678,766
প্রতিক্রিয়া সময় (গড়) 100.31s 58.06s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 560.39s 817.57s
প্রতিক্রিয়া সময় (মোট) 2206.82s 1161.18s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#91 LongCat 2.0

low
খরচ
$0.024
সময়
428.0s
টোকেন
19,557 tok

#90 Qwen3.6 35B A3B

medium
অবৈধ SVG
খরচ
$0.000
সময়
300.0s
টোকেন
0 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
LongCat 2.0 6.6 4.6 77.8% 2 479.30s 6,544 461 206,627
Qwen3.6 35B A3B 7.7 10.0 66.7% 0 50.55s 5,051 7,929 37,223

দ্রুত তুলনা

তুলনার জুটি বদলান