নেভিগেশন
AI BENCHY
Advertise here

Poolside: Laguna S 2.1 vs Qwen: Qwen3.6 35B A3B

average score প্রায় সমান: 5.4 vs 5.3. Qwen3.6 35B A3B-এর benchmark খরচ কম: $0.061 vs $0.127. Qwen3.6 35B A3B দ্রুত: 5.52s vs 111.61s, pass rates 27.3% vs 31.8%.

প্রস্তাবিত মডেলQwen3.6 35B A3BIt has the best score here (5.3), while costing about 2.1x less than Laguna S 2.1 (high).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-22

মেট্রিক Laguna S 2.1 Laguna S 2.1 high প্রকাশ: 2026-07-21 বিনামূল্যে উপলভ্য Qwen3.6 35B A3B Qwen3.6 35B A3B none প্রকাশ: 2026-04-20
স্কোর 5.4 5.3
র‍্যাঙ্ক #167 #169
নির্ভরযোগ্যতা 9.9 10.0
ধারাবাহিকতা 8.1 7.7
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 27.3% 31.8%
অস্থির টেস্ট 5 6
মোট রান 66 66
প্রতি ফলাফলে খরচ 3.153 1.496
মোট খরচ $0.127 $0.061
ইনপুট মূল্য $0.100 / 1M $0.140 / 1M
আউটপুট মূল্য $0.200 / 1M $1.000 / 1M
মোট ইনপুট টোকেন 208,931 93,979
আউটপুট টোকেন 175,588 46,957
রিজনিং টোকেন 409,276 0
প্রতিক্রিয়া সময় (গড়) 111.61s 5.52s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 1190.11s 39.54s
প্রতিক্রিয়া সময় (মোট) 2455.39s 110.40s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#167 Laguna S 2.1

high
খরচ
$0.001
সময়
6.8s
টোকেন
1,389 tok

#169 Qwen3.6 35B A3B

none
খরচ
$0.008
সময়
30.1s
টোকেন
6,317 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Laguna S 2.1 5.3 7.2 44.4% 1 271.42s 6,496 59,355 151,009
Qwen3.6 35B A3B 5.5 10.0 33.3% 0 8.77s 7,911 11,161 0

দ্রুত তুলনা

তুলনার জুটি বদলান