नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Poolside: Laguna S 2.1 vs Qwen: Qwen3.6 35B A3B

average score लगभग बराबर है: 5.4 vs 5.3. Qwen3.6 35B A3B की benchmark लागत कम है: $0.061 vs $0.127. Qwen3.6 35B A3B तेज है: 5.52s vs 111.61s, pass rates 27.3% vs 31.8%.

अनुशंसित मॉडलQwen3.6 35B A3BIt has the best score here (5.3), while costing about 2.1x less than Laguna S 2.1 (high).

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-22

मेट्रिक Laguna S 2.1 Laguna S 2.1 high रिलीज़: 2026-07-21 निःशुल्क उपलब्ध Qwen3.6 35B A3B Qwen3.6 35B A3B none रिलीज़: 2026-04-20
स्कोर 5.4 5.3
रैंक #167 #169
विश्वसनीयता 9.9 10.0
संगति 8.1 7.7
सही परीक्षण
प्रति प्रयास पास दर 27.3% 31.8%
अस्थिर टेस्ट 5 6
कुल रन 66 66
प्रति परिणाम लागत 3.153 1.496
कुल लागत $0.127 $0.061
इनपुट कीमत $0.100 / 1M $0.140 / 1M
आउटपुट कीमत $0.200 / 1M $1.000 / 1M
कुल इनपुट टोकन 208,931 93,979
आउटपुट टोकन 175,588 46,957
रीजनिंग टोकन 409,276 0
प्रतिक्रिया समय (औसत) 111.61s 5.52s
प्रतिक्रिया समय (अधिकतम) 1190.11s 39.54s
प्रतिक्रिया समय (कुल) 2455.39s 110.40s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#167 Laguna S 2.1

high
लागत
$0.001
समय
6.8s
टोकन
1,389 tok

#169 Qwen3.6 35B A3B

none
लागत
$0.008
समय
30.1s
टोकन
6,317 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Laguna S 2.1 5.3 7.2 44.4% 1 271.42s 6,496 59,355 151,009
Qwen3.6 35B A3B 5.5 10.0 33.3% 0 8.77s 7,911 11,161 0

त्वरित तुलना

तुलना जोड़ी बदलें