नेविगेशन
AI BENCHY
Advertise here

Laguna S 2.1 (high) vs Qwen3.8 27B

Qwen3.8 27B average score में आगे है: 5.5 vs 5.4. स्थानीय हार्डवेयर की लागत नहीं मापी गई, इसलिए लागत की तुलना उपलब्ध नहीं है। Qwen3.8 27B तेज है: 3.12s vs 111.60s, pass rates 27.3% vs 40.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-15

रैंक
#220
कुल आउटपुट टोकन
584,864
प्रतिक्रिया समय (औसत)
111.60s
कुल लागत
$0.114
रैंक
#211
कुल आउटपुट टोकन
11,445
प्रतिक्रिया समय (औसत)
3.12s
कुल लागत
लागू नहीं
अनुशंसित मॉडल Qwen3.8 27B

It has the best score here (5.5), while responding about 35.7x faster than Laguna S 2.1 (high).

विस्तृत तुलना

मेट्रिक Laguna S 2.1 Laguna S 2.1 high रिलीज़: 2026-07-21 निःशुल्क उपलब्ध Qwen3.8 27B Qwen3.8 27B none रिलीज़: 2026-08-14
स्कोर 5.4 5.5
रैंक #220 #211
विश्वसनीयता 10.0 10.0
संगति 8.1 10.0
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 27.3% 40.9%
अस्थिर टेस्ट 5 0
कुल रन 66 66
प्रति परिणाम लागत 3.153 लागू नहीं
कुल लागत $0.114 लागू नहीं
इनपुट कीमत $0.090 / 1M लागू नहीं
आउटपुट कीमत $0.180 / 1M लागू नहीं
कुल इनपुट टोकन 208,937 122,463
आउटपुट टोकन 175,588 11,445
रीजनिंग टोकन 409,276 0
प्रतिक्रिया समय (औसत) 111.60s 3.12s
प्रतिक्रिया समय (अधिकतम) 1190.11s 44.76s
प्रतिक्रिया समय (कुल) 2455.24s 68.69s
पैरामीटर 118B कुल (8B सक्रिय) 27.3B
उपलब्धता वेट उपलब्ध वेट उपलब्ध

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#220 Laguna S 2.1

high
लागत
$0.001
समय
6.8s
टोकन
1,389 tok

#211 Qwen3.8 27B

none
लागत
लागू नहीं
समय
23.9s
टोकन
1,922 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Laguna S 2.1 5.3 7.2 44.4% 1 271.42s 6,496 59,355 151,009
Qwen3.8 27B 5.5 10.0 33.3% 0 1.19s 7,911 408 0

त्वरित तुलना

तुलना जोड़ी बदलें