নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Poolside: Laguna S 2.1 vs Qwen: Qwen3.5-9B

Laguna S 2.1 (high) average score-এ এগিয়ে: 5.4 vs 5.1. Qwen3.5-9B-এর benchmark খরচ কম: $0.021 vs $0.127. Qwen3.5-9B দ্রুত: 19.17s vs 111.61s, pass rates 27.3% vs 19.7%.

প্রস্তাবিত মডেলQwen3.5-9BIts score stays close to the best score here (5.1 vs 5.4), while costing about 6.3x less than Laguna S 2.1 (high).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-22

মেট্রিক Laguna S 2.1 Laguna S 2.1 high প্রকাশ: 2026-07-21 বিনামূল্যে উপলভ্য Qwen3.5-9B Qwen3.5-9B none প্রকাশ: 2026-03-02
স্কোর 5.4 5.1
র‍্যাঙ্ক #167 #177
নির্ভরযোগ্যতা 9.9 10.0
ধারাবাহিকতা 8.1 9.7
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 27.3% 19.7%
অস্থির টেস্ট 5 1
মোট রান 66 66
প্রতি ফলাফলে খরচ 3.153 0.490
মোট খরচ $0.127 $0.021
ইনপুট মূল্য $0.100 / 1M $0.100 / 1M
আউটপুট মূল্য $0.200 / 1M $0.150 / 1M
মোট ইনপুট টোকেন 208,931 144,407
আউটপুট টোকেন 175,588 37,484
রিজনিং টোকেন 409,276 0
প্রতিক্রিয়া সময় (গড়) 111.61s 19.17s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 1190.11s 382.06s
প্রতিক্রিয়া সময় (মোট) 2455.39s 421.74s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#167 Laguna S 2.1

high
খরচ
$0.001
সময়
6.8s
টোকেন
1,389 tok

#177 Qwen3.5-9B

none
অবৈধ SVG
খরচ
$0.000
সময়
300.0s
টোকেন
0 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Laguna S 2.1 5.3 7.2 44.4% 1 271.42s 6,496 59,355 151,009
Qwen3.5-9B 3.9 7.8 11.1% 1 5.60s 7,913 1,042 0

দ্রুত তুলনা

তুলনার জুটি বদলান