নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Poolside: Laguna S 2.1 vs Qwen: Qwen3.6 27B

Qwen3.6 27B average score-এ এগিয়ে: 5.5 vs 5.4. Qwen3.6 27B-এর benchmark খরচ কম: $0.087 vs $0.127. Qwen3.6 27B দ্রুত: 10.65s vs 111.61s, pass rates 27.3% vs 45.5%.

প্রস্তাবিত মডেলQwen3.6 27BIt has the best score here (5.5), while responding about 10.5x faster than Laguna S 2.1 (high).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-22

মেট্রিক Laguna S 2.1 Laguna S 2.1 high প্রকাশ: 2026-07-21 বিনামূল্যে উপলভ্য Qwen3.6 27B Qwen3.6 27B none প্রকাশ: 2026-04-20
স্কোর 5.4 5.5
র‍্যাঙ্ক #167 #158
নির্ভরযোগ্যতা 9.9 10.0
ধারাবাহিকতা 8.1 7.6
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 27.3% 45.5%
অস্থির টেস্ট 5 6
মোট রান 66 66
প্রতি ফলাফলে খরচ 3.153 1.220
মোট খরচ $0.127 $0.087
ইনপুট মূল্য $0.100 / 1M $0.450 / 1M
আউটপুট মূল্য $0.200 / 1M $2.700 / 1M
মোট ইনপুট টোকেন 208,931 95,796
আউটপুট টোকেন 175,588 16,155
রিজনিং টোকেন 409,276 0
প্রতিক্রিয়া সময় (গড়) 111.61s 10.65s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 1190.11s 156.31s
প্রতিক্রিয়া সময় (মোট) 2455.39s 234.39s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#167 Laguna S 2.1

high
খরচ
$0.001
সময়
6.8s
টোকেন
1,389 tok

#158 Qwen3.6 27B

none
খরচ
$0.009
সময়
83.0s
টোকেন
4,549 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Laguna S 2.1 5.3 7.2 44.4% 1 271.42s 6,496 59,355 151,009
Qwen3.6 27B 5.5 10.0 33.3% 0 4.16s 7,913 539 0

দ্রুত তুলনা

তুলনার জুটি বদলান