নেভিগেশন
AI BENCHY
Advertise here

Poolside: Laguna S 2.1 vs Qwen: Qwen3.6 27B

Qwen3.6 27B average score-এ এগিয়ে: 5.5 vs 5.4. Laguna S 2.1 (medium)-এর benchmark খরচ কম: $0.059 vs $0.087. Qwen3.6 27B দ্রুত: 10.65s vs 58.43s, pass rates 25.8% vs 45.5%.

প্রস্তাবিত মডেলQwen3.6 27BIt has the best score here (5.5), while responding about 5.5x faster than Laguna S 2.1 (medium).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-22

মেট্রিক Laguna S 2.1 Laguna S 2.1 medium প্রকাশ: 2026-07-21 বিনামূল্যে উপলভ্য Qwen3.6 27B Qwen3.6 27B none প্রকাশ: 2026-04-20
স্কোর 5.4 5.5
র‍্যাঙ্ক #164 #158
নির্ভরযোগ্যতা 9.8 10.0
ধারাবাহিকতা 8.4 7.6
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 25.8% 45.5%
অস্থির টেস্ট 4 6
মোট রান 66 66
প্রতি ফলাফলে খরচ 1.451 1.220
মোট খরচ $0.059 $0.087
ইনপুট মূল্য $0.100 / 1M $0.450 / 1M
আউটপুট মূল্য $0.200 / 1M $2.700 / 1M
মোট ইনপুট টোকেন 86,641 95,796
আউটপুট টোকেন 97,298 16,155
রিজনিং টোকেন 242,297 0
প্রতিক্রিয়া সময় (গড়) 58.43s 10.65s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 560.31s 156.31s
প্রতিক্রিয়া সময় (মোট) 1285.48s 234.39s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#164 Laguna S 2.1

medium
খরচ
$0.001
সময়
4.0s
টোকেন
867 tok

#158 Qwen3.6 27B

none
খরচ
$0.009
সময়
83.0s
টোকেন
4,549 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Laguna S 2.1 5.3 7.2 44.4% 1 158.98s 7,917 93,354 106,718
Qwen3.6 27B 5.5 10.0 33.3% 0 4.16s 7,913 539 0

দ্রুত তুলনা

তুলনার জুটি বদলান