নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Poolside: Laguna S 2.1 vs Qwen: Qwen3.5-122B-A10B

Qwen3.5-122B-A10B average score-এ এগিয়ে: 5.7 vs 5.4. Laguna S 2.1 (medium)-এর benchmark খরচ কম: $0.059 vs $0.247. Qwen3.5-122B-A10B দ্রুত: 12.92s vs 58.43s, pass rates 25.8% vs 33.3%.

প্রস্তাবিত মডেলQwen3.5-122B-A10BIt has the best score here (5.7), while responding about 4.5x faster than Laguna S 2.1 (medium).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-22

মেট্রিক Laguna S 2.1 Laguna S 2.1 medium প্রকাশ: 2026-07-21 বিনামূল্যে উপলভ্য Qwen3.5-122B-A10B Qwen3.5-122B-A10B none প্রকাশ: 2026-02-24
স্কোর 5.4 5.7
র‍্যাঙ্ক #164 #148
নির্ভরযোগ্যতা 9.8 10.0
ধারাবাহিকতা 8.4 9.3
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 25.8% 33.3%
অস্থির টেস্ট 4 2
মোট রান 66 66
প্রতি ফলাফলে খরচ 1.451 4.182
মোট খরচ $0.059 $0.247
ইনপুট মূল্য $0.100 / 1M $0.260 / 1M
আউটপুট মূল্য $0.200 / 1M $2.080 / 1M
মোট ইনপুট টোকেন 86,641 241,566
আউটপুট টোকেন 97,298 88,458
রিজনিং টোকেন 242,297 0
প্রতিক্রিয়া সময় (গড়) 58.43s 12.92s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 560.31s 212.63s
প্রতিক্রিয়া সময় (মোট) 1285.48s 284.21s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#164 Laguna S 2.1

medium
খরচ
$0.001
সময়
4.0s
টোকেন
867 tok

#148 Qwen3.5-122B-A10B

none
খরচ
$0.016
সময়
44.5s
টোকেন
6,431 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Laguna S 2.1 5.3 7.2 44.4% 1 158.98s 7,917 93,354 106,718
Qwen3.5-122B-A10B 3.7 7.0 22.2% 1 2.77s 7,913 693 0

দ্রুত তুলনা

তুলনার জুটি বদলান