नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Poolside: Laguna S 2.1 vs Qwen: Qwen3.6 27B

Qwen3.6 27B average score मध्ये पुढे आहे: 5.5 vs 5.4. Laguna S 2.1 (medium) चा benchmark खर्च कमी आहे: $0.059 vs $0.087. Qwen3.6 27B वेगवान आहे: 10.65s vs 58.43s, pass rates 25.8% vs 45.5%.

शिफारस केलेले मॉडेलQwen3.6 27BIt has the best score here (5.5), while responding about 5.5x faster than Laguna S 2.1 (medium).

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-22

मेट्रिक Laguna S 2.1 Laguna S 2.1 medium प्रकाशन: 2026-07-21 मोफत उपलब्ध Qwen3.6 27B Qwen3.6 27B none प्रकाशन: 2026-04-20
स्कोअर 5.4 5.5
क्रमांक #164 #158
विश्वसनीयता 9.8 10.0
सुसंगतता 8.4 7.6
बरोबर चाचण्या
प्रति प्रयत्न पास दर 25.8% 45.5%
अस्थिर चाचण्या 4 6
एकूण रन 66 66
प्रति निकाल खर्च 1.451 1.220
एकूण खर्च $0.059 $0.087
इनपुट किंमत $0.100 / 1M $0.450 / 1M
आउटपुट किंमत $0.200 / 1M $2.700 / 1M
एकूण इनपुट टोकन्स 86,641 95,796
आउटपुट टोकन्स 97,298 16,155
रिझनिंग टोकन्स 242,297 0
प्रतिसाद वेळ (सरासरी) 58.43s 10.65s
प्रतिसाद वेळ (कमाल) 560.31s 156.31s
प्रतिसाद वेळ (एकूण) 1285.48s 234.39s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#164 Laguna S 2.1

medium
खर्च
$0.001
वेळ
4.0s
टोकन्स
867 tok

#158 Qwen3.6 27B

none
खर्च
$0.009
वेळ
83.0s
टोकन्स
4,549 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Laguna S 2.1 5.3 7.2 44.4% 1 158.98s 7,917 93,354 106,718
Qwen3.6 27B 5.5 10.0 33.3% 0 4.16s 7,913 539 0

झटपट तुलना

तुलना जोडी बदला