نیویگیشن
AI BENCHY
Advertise here

Poolside: Laguna S 2.1 vs Qwen: Qwen3.5-9B

Laguna S 2.1 (medium) average score میں آگے ہے: 5.4 vs 5.1. Qwen3.5-9B کی benchmark لاگت کم ہے: $0.021 vs $0.059. Qwen3.5-9B تیز ہے: 19.17s vs 58.43s، pass rates 25.8% vs 19.7%.

تجویز کردہ ماڈلQwen3.5-9BIts score stays close to the best score here (5.1 vs 5.4), while costing about 2.9x less than Laguna S 2.1 (medium).

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-07-22

میٹرک Laguna S 2.1 Laguna S 2.1 medium اجرا: 2026-07-21 مفت دستیاب Qwen3.5-9B Qwen3.5-9B none اجرا: 2026-03-02
اسکور 5.4 5.1
درجہ #164 #177
اعتماد پذیری 9.8 10.0
تسلسل 8.4 9.7
درست ٹیسٹس
فی کوشش کامیابی کی شرح 25.8% 19.7%
غیر مستحکم ٹیسٹ 4 1
کل رنز 66 66
فی نتیجہ لاگت 1.451 0.490
کل لاگت $0.059 $0.021
ان پٹ قیمت $0.100 / 1M $0.100 / 1M
آؤٹ پٹ قیمت $0.200 / 1M $0.150 / 1M
کل ان پٹ ٹوکنز 86,641 144,407
آؤٹ پٹ ٹوکنز 97,298 37,484
ریزننگ ٹوکنز 242,297 0
ردِعمل کا وقت (اوسط) 58.43s 19.17s
ردِعمل کا وقت (زیادہ سے زیادہ) 560.31s 382.06s
ردِعمل کا وقت (کل) 1285.48s 421.74s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#164 Laguna S 2.1

medium
لاگت
$0.001
وقت
4.0s
ٹوکنز
867 tok

#177 Qwen3.5-9B

none
غلط SVG
لاگت
$0.000
وقت
300.0s
ٹوکنز
0 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Laguna S 2.1 5.3 7.2 44.4% 1 158.98s 7,917 93,354 106,718
Qwen3.5-9B 3.9 7.8 11.1% 1 5.60s 7,913 1,042 0

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں