नेविगेशन
AI BENCHY
Advertise here

Laguna S 2.1 (medium) vs Qwen3.6 27B

Qwen3.6 27B average score में आगे है: 5.5 vs 5.4. Laguna S 2.1 (medium) की benchmark लागत कम है: $0.053 vs $0.062. Qwen3.6 27B तेज है: 10.62s vs 58.42s, pass rates 24.2% vs 45.5%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-04

रैंक
#239
कुल आउटपुट टोकन
339,595
प्रतिक्रिया समय (औसत)
58.42s
कुल लागत
$0.053
रैंक
#234
कुल आउटपुट टोकन
16,156
प्रतिक्रिया समय (औसत)
10.62s
कुल लागत
$0.062
अनुशंसित मॉडल Qwen3.6 27B

It has the best score here (5.5), while responding about 5.5x faster than Laguna S 2.1 (medium).

विस्तृत तुलना

मेट्रिक Laguna S 2.1 Laguna S 2.1 medium रिलीज़: 2026-07-21 निःशुल्क उपलब्ध Qwen3.6 27B Qwen3.6 27B none रिलीज़: 2026-04-20
स्कोर 5.4 5.5
रैंक #239 #234
विश्वसनीयता 10.0 10.0
संगति 8.8 7.6
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 24.2% 45.5%
अस्थिर टेस्ट 3 6
कुल रन 66 66
प्रति परिणाम लागत 1.451 1.220
कुल लागत $0.053 $0.062
इनपुट कीमत $0.090 / 1M $0.300 / 1M
आउटपुट कीमत $0.180 / 1M $2.000 / 1M
कुल इनपुट टोकन 86,647 95,805
आउटपुट टोकन 97,298 16,156
रीजनिंग टोकन 242,297 0
प्रतिक्रिया समय (औसत) 58.42s 10.62s
प्रतिक्रिया समय (अधिकतम) 560.31s 156.31s
प्रतिक्रिया समय (कुल) 1285.26s 233.68s
पैरामीटर 118B कुल (8B सक्रिय) 27B
उपलब्धता वेट उपलब्ध मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#239 Laguna S 2.1

medium
लागत
$0.001
समय
4.0s
टोकन
867 tok

#234 Qwen3.6 27B

none
लागत
$0.009
समय
83.0s
टोकन
4,549 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Laguna S 2.1 5.3 7.2 44.4% 1 158.98s 7,917 93,354 106,718
Qwen3.6 27B 5.5 10.0 33.3% 0 4.16s 7,913 539 0

त्वरित तुलना

तुलना जोड़ी बदलें