नेविगेशन
AI BENCHY
Advertise here

Poolside: Laguna S 2.1 vs Qwen: Qwen3.6 35B A3B

Laguna S 2.1 (medium) average score में आगे है: 5.4 vs 5.3. Laguna S 2.1 (medium) की benchmark लागत कम है: $0.059 vs $0.061. Qwen3.6 35B A3B तेज है: 5.52s vs 58.43s, pass rates 25.8% vs 31.8%.

अनुशंसित मॉडलQwen3.6 35B A3BIts score stays close to the best score here (5.3 vs 5.4), while responding about 10.6x faster than Laguna S 2.1 (medium).

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-22

मेट्रिक Laguna S 2.1 Laguna S 2.1 medium रिलीज़: 2026-07-21 निःशुल्क उपलब्ध Qwen3.6 35B A3B Qwen3.6 35B A3B none रिलीज़: 2026-04-20
स्कोर 5.4 5.3
रैंक #164 #169
विश्वसनीयता 9.8 10.0
संगति 8.4 7.7
सही परीक्षण
प्रति प्रयास पास दर 25.8% 31.8%
अस्थिर टेस्ट 4 6
कुल रन 66 66
प्रति परिणाम लागत 1.451 1.496
कुल लागत $0.059 $0.061
इनपुट कीमत $0.100 / 1M $0.140 / 1M
आउटपुट कीमत $0.200 / 1M $1.000 / 1M
कुल इनपुट टोकन 86,641 93,979
आउटपुट टोकन 97,298 46,957
रीजनिंग टोकन 242,297 0
प्रतिक्रिया समय (औसत) 58.43s 5.52s
प्रतिक्रिया समय (अधिकतम) 560.31s 39.54s
प्रतिक्रिया समय (कुल) 1285.48s 110.40s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#164 Laguna S 2.1

medium
लागत
$0.001
समय
4.0s
टोकन
867 tok

#169 Qwen3.6 35B A3B

none
लागत
$0.008
समय
30.1s
टोकन
6,317 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Laguna S 2.1 5.3 7.2 44.4% 1 158.98s 7,917 93,354 106,718
Qwen3.6 35B A3B 5.5 10.0 33.3% 0 8.77s 7,911 11,161 0

त्वरित तुलना

तुलना जोड़ी बदलें