নেভিগেশন
AI BENCHY
Advertise here

Poolside: Laguna S 2.1 vs Qwen: Qwen3.5-9B

Laguna S 2.1 average score-এ এগিয়ে: 4.5 vs 3.8. Laguna S 2.1-এর benchmark খরচ কম: $0.025 vs $0.036. Laguna S 2.1 দ্রুত: 11.67s vs 82.24s, pass rates 15.2% vs 25.8%.

প্রস্তাবিত মডেলLaguna S 2.1It has the best score here (4.5), while responding about 7.0x faster than Qwen3.5-9B (medium).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-22

মেট্রিক Laguna S 2.1 Laguna S 2.1 none প্রকাশ: 2026-07-21 বিনামূল্যে উপলভ্য Qwen3.5-9B Qwen3.5-9B medium প্রকাশ: 2026-03-02
স্কোর 4.5 3.8
র‍্যাঙ্ক #200 #214
নির্ভরযোগ্যতা 10.0 5.0
ধারাবাহিকতা 8.8 8.1
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 15.2% 25.8%
অস্থির টেস্ট 3 5
মোট রান 66 66
প্রতি ফলাফলে খরচ 1.205 1.187
মোট খরচ $0.025 $0.036
ইনপুট মূল্য $0.100 / 1M $0.100 / 1M
আউটপুট মূল্য $0.200 / 1M $0.150 / 1M
মোট ইনপুট টোকেন 125,598 17,070
আউটপুট টোকেন 57,634 29,045
রিজনিং টোকেন 0 209,516
প্রতিক্রিয়া সময় (গড়) 11.67s 82.24s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 200.52s 226.38s
প্রতিক্রিয়া সময় (মোট) 256.80s 1315.88s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#200 Laguna S 2.1

none
খরচ
$0.001
সময়
7.6s
টোকেন
1,345 tok

#214 Qwen3.5-9B

medium
খরচ
$0.001
সময়
35.9s
টোকেন
3,030 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Laguna S 2.1 3.4 9.7 0.0% 0 550ms 7,917 424 0
Qwen3.5-9B 2.9 10.0 0.0% 0 100.88s 2,396 7,890 41,129

দ্রুত তুলনা

তুলনার জুটি বদলান