নেভিগেশন
AI BENCHY
Advertise here

Poolside: Laguna S 2.1 vs Qwen: Qwen3.6 35B A3B

Laguna S 2.1 (medium) average score-এ এগিয়ে: 5.4 vs 5.3. Laguna S 2.1 (medium)-এর benchmark খরচ কম: $0.059 vs $0.061. Qwen3.6 35B A3B দ্রুত: 5.52s vs 58.43s, pass rates 25.8% vs 31.8%.

প্রস্তাবিত মডেলQwen3.6 35B A3BIts score stays close to the best score here (5.3 vs 5.4), while responding about 10.6x faster than Laguna S 2.1 (medium).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-22

মেট্রিক Laguna S 2.1 Laguna S 2.1 medium প্রকাশ: 2026-07-21 বিনামূল্যে উপলভ্য Qwen3.6 35B A3B Qwen3.6 35B A3B none প্রকাশ: 2026-04-20
স্কোর 5.4 5.3
র‍্যাঙ্ক #164 #169
নির্ভরযোগ্যতা 9.8 10.0
ধারাবাহিকতা 8.4 7.7
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 25.8% 31.8%
অস্থির টেস্ট 4 6
মোট রান 66 66
প্রতি ফলাফলে খরচ 1.451 1.496
মোট খরচ $0.059 $0.061
ইনপুট মূল্য $0.100 / 1M $0.140 / 1M
আউটপুট মূল্য $0.200 / 1M $1.000 / 1M
মোট ইনপুট টোকেন 86,641 93,979
আউটপুট টোকেন 97,298 46,957
রিজনিং টোকেন 242,297 0
প্রতিক্রিয়া সময় (গড়) 58.43s 5.52s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 560.31s 39.54s
প্রতিক্রিয়া সময় (মোট) 1285.48s 110.40s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#164 Laguna S 2.1

medium
খরচ
$0.001
সময়
4.0s
টোকেন
867 tok

#169 Qwen3.6 35B A3B

none
খরচ
$0.008
সময়
30.1s
টোকেন
6,317 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Laguna S 2.1 5.3 7.2 44.4% 1 158.98s 7,917 93,354 106,718
Qwen3.6 35B A3B 5.5 10.0 33.3% 0 8.77s 7,911 11,161 0

দ্রুত তুলনা

তুলনার জুটি বদলান