नेव्हिगेशन
AI BENCHY
Advertise here

Laguna XS 2.1 (medium) vs Qwen3.5-27B

Qwen3.5-27B average score मध्ये पुढे आहे: 6.6 vs 6.5. Qwen3.5-27B चा benchmark खर्च कमी आहे: $0.058 vs $0.068. Qwen3.5-27B वेगवान आहे: 4.77s vs 48.18s, pass rates 45.5% vs 45.5%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-29

क्रमांक
#155
एकूण आउटपुट टोकन्स
522,480
प्रतिसाद वेळ (सरासरी)
48.18s
एकूण खर्च
$0.068
क्रमांक
#148
एकूण आउटपुट टोकन्स
24,323
प्रतिसाद वेळ (सरासरी)
4.77s
एकूण खर्च
$0.058
शिफारस केलेले मॉडेल Qwen3.5-27B

It has the best score here (6.6), while responding about 10.1x faster than Laguna XS 2.1 (medium).

तपशीलवार तुलना

मेट्रिक Laguna XS 2.1 Laguna XS 2.1 medium प्रकाशन: 2026-07-02 मोफत उपलब्ध Qwen3.5-27B Qwen3.5-27B none प्रकाशन: 2026-02-24
स्कोअर 6.5 6.6
क्रमांक #155 #148
विश्वसनीयता 10.0 10.0
सुसंगतता 9.2 9.3
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 45.5% 45.5%
अस्थिर चाचण्या 2 2
एकूण रन 66 66
प्रति निकाल खर्च 0.745 0.678
एकूण खर्च $0.068 $0.058
इनपुट किंमत $0.060 / 1M $0.195 / 1M
आउटपुट किंमत $0.120 / 1M $1.560 / 1M
एकूण इनपुट टोकन्स 118,998 102,325
आउटपुट टोकन्स 30,750 24,323
रिझनिंग टोकन्स 491,730 0
प्रतिसाद वेळ (सरासरी) 48.18s 4.77s
प्रतिसाद वेळ (कमाल) 422.72s 69.46s
प्रतिसाद वेळ (एकूण) 1059.93s 105.00s
पॅरामीटर्स 33B एकूण (3B सक्रिय) 27B
उपलब्धता वेट्स उपलब्ध मुक्त स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#155 Laguna XS 2.1

medium
खर्च
$0.001
वेळ
30.6s
टोकन्स
4,678 tok

#148 Qwen3.5-27B

none
खर्च
$0.007
वेळ
42.9s
टोकन्स
4,273 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Laguna XS 2.1 5.5 10.0 33.3% 0 70.35s 7,995 23,767 83,258
Qwen3.5-27B 5.8 10.0 33.3% 0 1.80s 7,913 415 0

झटपट तुलना

तुलना जोडी बदला