नेव्हिगेशन
AI BENCHY
Advertise here

Poolside: Laguna S 2.1 vs Qwen: Qwen3.5-9B

Laguna S 2.1 (medium) average score मध्ये पुढे आहे: 5.4 vs 5.1. Qwen3.5-9B चा benchmark खर्च कमी आहे: $0.021 vs $0.059. Qwen3.5-9B वेगवान आहे: 19.17s vs 58.43s, pass rates 25.8% vs 19.7%.

शिफारस केलेले मॉडेलQwen3.5-9BIts score stays close to the best score here (5.1 vs 5.4), while costing about 2.9x less than Laguna S 2.1 (medium).

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-22

मेट्रिक Laguna S 2.1 Laguna S 2.1 medium प्रकाशन: 2026-07-21 मोफत उपलब्ध Qwen3.5-9B Qwen3.5-9B none प्रकाशन: 2026-03-02
स्कोअर 5.4 5.1
क्रमांक #164 #177
विश्वसनीयता 9.8 10.0
सुसंगतता 8.4 9.7
बरोबर चाचण्या
प्रति प्रयत्न पास दर 25.8% 19.7%
अस्थिर चाचण्या 4 1
एकूण रन 66 66
प्रति निकाल खर्च 1.451 0.490
एकूण खर्च $0.059 $0.021
इनपुट किंमत $0.100 / 1M $0.100 / 1M
आउटपुट किंमत $0.200 / 1M $0.150 / 1M
एकूण इनपुट टोकन्स 86,641 144,407
आउटपुट टोकन्स 97,298 37,484
रिझनिंग टोकन्स 242,297 0
प्रतिसाद वेळ (सरासरी) 58.43s 19.17s
प्रतिसाद वेळ (कमाल) 560.31s 382.06s
प्रतिसाद वेळ (एकूण) 1285.48s 421.74s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#164 Laguna S 2.1

medium
खर्च
$0.001
वेळ
4.0s
टोकन्स
867 tok

#177 Qwen3.5-9B

none
अवैध SVG
खर्च
$0.000
वेळ
300.0s
टोकन्स
0 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Laguna S 2.1 5.3 7.2 44.4% 1 158.98s 7,917 93,354 106,718
Qwen3.5-9B 3.9 7.8 11.1% 1 5.60s 7,913 1,042 0

झटपट तुलना

तुलना जोडी बदला