নেভিগেশন
AI BENCHY
Advertise here

Poolside: Laguna S 2.1 vs Qwen: Qwen3.5-9B

Qwen3.5-9B average score-এ এগিয়ে: 5.1 vs 5.0. Qwen3.5-9B-এর benchmark খরচ কম: $0.021 vs $0.091. Qwen3.5-9B দ্রুত: 19.17s vs 85.35s, pass rates 25.8% vs 19.7%.

প্রস্তাবিত মডেলQwen3.5-9BIt has the best score here (5.1), while costing about 4.5x less than Laguna S 2.1 (low).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-22

মেট্রিক Laguna S 2.1 Laguna S 2.1 low প্রকাশ: 2026-07-21 বিনামূল্যে উপলভ্য Qwen3.5-9B Qwen3.5-9B none প্রকাশ: 2026-03-02
স্কোর 5.0 5.1
র‍্যাঙ্ক #181 #177
নির্ভরযোগ্যতা 9.9 10.0
ধারাবাহিকতা 7.8 9.7
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 25.8% 19.7%
অস্থির টেস্ট 6 1
মোট রান 66 66
প্রতি ফলাফলে খরচ 3.022 0.490
মোট খরচ $0.091 $0.021
ইনপুট মূল্য $0.100 / 1M $0.100 / 1M
আউটপুট মূল্য $0.200 / 1M $0.150 / 1M
মোট ইনপুট টোকেন 118,746 144,407
আউটপুট টোকেন 67,823 37,484
রিজনিং টোকেন 383,885 0
প্রতিক্রিয়া সময় (গড়) 85.35s 19.17s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 814.73s 382.06s
প্রতিক্রিয়া সময় (মোট) 1877.64s 421.74s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#181 Laguna S 2.1

low
খরচ
$0.001
সময়
6.6s
টোকেন
1,314 tok

#177 Qwen3.5-9B

none
অবৈধ SVG
খরচ
$0.000
সময়
300.0s
টোকেন
0 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Laguna S 2.1 3.8 7.1 22.2% 1 167.51s 7,917 58,111 119,138
Qwen3.5-9B 3.9 7.8 11.1% 1 5.60s 7,913 1,042 0

দ্রুত তুলনা

তুলনার জুটি বদলান