नेविगेशन
AI BENCHY
Advertise here

Laguna XS 2.1 (medium) vs Qwen3.5-27B

Qwen3.5-27B average score में आगे है: 6.6 vs 6.5. Qwen3.5-27B की benchmark लागत कम है: $0.058 vs $0.068. Qwen3.5-27B तेज है: 4.77s vs 48.18s, pass rates 45.5% vs 45.5%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-29

रैंक
#155
कुल आउटपुट टोकन
522,480
प्रतिक्रिया समय (औसत)
48.18s
कुल लागत
$0.068
रैंक
#148
कुल आउटपुट टोकन
24,323
प्रतिक्रिया समय (औसत)
4.77s
कुल लागत
$0.058
अनुशंसित मॉडल Qwen3.5-27B

It has the best score here (6.6), while responding about 10.1x faster than Laguna XS 2.1 (medium).

विस्तृत तुलना

मेट्रिक Laguna XS 2.1 Laguna XS 2.1 medium रिलीज़: 2026-07-02 निःशुल्क उपलब्ध Qwen3.5-27B Qwen3.5-27B none रिलीज़: 2026-02-24
स्कोर 6.5 6.6
रैंक #155 #148
विश्वसनीयता 10.0 10.0
संगति 9.2 9.3
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 45.5% 45.5%
अस्थिर टेस्ट 2 2
कुल रन 66 66
प्रति परिणाम लागत 0.745 0.678
कुल लागत $0.068 $0.058
इनपुट कीमत $0.060 / 1M $0.195 / 1M
आउटपुट कीमत $0.120 / 1M $1.560 / 1M
कुल इनपुट टोकन 118,998 102,325
आउटपुट टोकन 30,750 24,323
रीजनिंग टोकन 491,730 0
प्रतिक्रिया समय (औसत) 48.18s 4.77s
प्रतिक्रिया समय (अधिकतम) 422.72s 69.46s
प्रतिक्रिया समय (कुल) 1059.93s 105.00s
पैरामीटर 33B कुल (3B सक्रिय) 27B
उपलब्धता वेट उपलब्ध मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#155 Laguna XS 2.1

medium
लागत
$0.001
समय
30.6s
टोकन
4,678 tok

#148 Qwen3.5-27B

none
लागत
$0.007
समय
42.9s
टोकन
4,273 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Laguna XS 2.1 5.5 10.0 33.3% 0 70.35s 7,995 23,767 83,258
Qwen3.5-27B 5.8 10.0 33.3% 0 1.80s 7,913 415 0

त्वरित तुलना

तुलना जोड़ी बदलें