नेविगेशन
AI BENCHY
Advertise here

Laguna S 2.1 (medium) vs Qwen3.8 27B

Qwen3.8 27B average score में आगे है: 5.5 vs 5.4. स्थानीय हार्डवेयर की लागत नहीं मापी गई, इसलिए लागत की तुलना उपलब्ध नहीं है। Qwen3.8 27B तेज है: 3.12s vs 58.42s, pass rates 24.2% vs 40.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-15

रैंक
#214
कुल आउटपुट टोकन
339,595
प्रतिक्रिया समय (औसत)
58.42s
कुल लागत
$0.053
रैंक
#211
कुल आउटपुट टोकन
11,445
प्रतिक्रिया समय (औसत)
3.12s
कुल लागत
लागू नहीं
अनुशंसित मॉडल Qwen3.8 27B

It has the best score here (5.5), while responding about 18.7x faster than Laguna S 2.1 (medium).

विस्तृत तुलना

मेट्रिक Laguna S 2.1 Laguna S 2.1 medium रिलीज़: 2026-07-21 निःशुल्क उपलब्ध Qwen3.8 27B Qwen3.8 27B none रिलीज़: 2026-08-14
स्कोर 5.4 5.5
रैंक #214 #211
विश्वसनीयता 10.0 10.0
संगति 8.8 10.0
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 24.2% 40.9%
अस्थिर टेस्ट 3 0
कुल रन 66 66
प्रति परिणाम लागत 1.451 लागू नहीं
कुल लागत $0.053 लागू नहीं
इनपुट कीमत $0.090 / 1M लागू नहीं
आउटपुट कीमत $0.180 / 1M लागू नहीं
कुल इनपुट टोकन 86,647 122,463
आउटपुट टोकन 97,298 11,445
रीजनिंग टोकन 242,297 0
प्रतिक्रिया समय (औसत) 58.42s 3.12s
प्रतिक्रिया समय (अधिकतम) 560.31s 44.76s
प्रतिक्रिया समय (कुल) 1285.26s 68.69s
पैरामीटर 118B कुल (8B सक्रिय) 27.3B
उपलब्धता वेट उपलब्ध वेट उपलब्ध

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#214 Laguna S 2.1

medium
लागत
$0.001
समय
4.0s
टोकन
867 tok

#211 Qwen3.8 27B

none
लागत
लागू नहीं
समय
23.9s
टोकन
1,922 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Laguna S 2.1 5.3 7.2 44.4% 1 158.98s 7,917 93,354 106,718
Qwen3.8 27B 5.5 10.0 33.3% 0 1.19s 7,911 408 0

त्वरित तुलना

तुलना जोड़ी बदलें