नेविगेशन
Advertise here

Laguna S 2.1 (high) vs Qwen3.5-9B

average score लगभग बराबर है: 4.9 vs 4.9. Qwen3.5-9B की benchmark लागत कम है: $0.041 vs $0.147. Qwen3.5-9B तेज है: 37.19s vs 113.63s, pass rates 27.5% vs 18.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#305
कुल आउटपुट टोकन
630,543
प्रतिक्रिया समय (औसत)
113.63s
कुल लागत
$0.147
रैंक
#309
कुल आउटपुट टोकन
70,427
प्रतिक्रिया समय (औसत)
37.19s
कुल लागत
$0.041
अनुशंसित मॉडल Qwen3.5-9B

It has the best score here (4.9), while costing about 3.6x less than Laguna S 2.1 (high).

विस्तृत तुलना

मेट्रिक Laguna S 2.1 Laguna S 2.1 high रिलीज़: 2026-07-21 निःशुल्क उपलब्ध Qwen3.5-9B Qwen3.5-9B none रिलीज़: 2026-03-02
स्कोर 4.9 4.9
रैंक #305 #309
विश्वसनीयता 10.0 9.8
संगति 7.8 9.7
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 27.5% 18.8%
अस्थिर टेस्ट 6 1
कुल रन 69 69
प्रति परिणाम लागत 3.664 1.022
कुल लागत $0.147 $0.041
इनपुट कीमत $0.090 / 1M $0.100 / 1M
आउटपुट कीमत $0.180 / 1M $0.150 / 1M
कुल इनपुट टोकन 344,806 307,670
आउटपुट टोकन 177,330 70,427
रीजनिंग टोकन 453,213 0
प्रतिक्रिया समय (औसत) 113.63s 37.19s
प्रतिक्रिया समय (अधिकतम) 1190.11s 433.02s
प्रतिक्रिया समय (कुल) 2613.48s 855.27s
पैरामीटर 118B कुल (8B सक्रिय) 9B
उपलब्धता वेट उपलब्ध मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#305 Laguna S 2.1

high
लागत
$0.001
समय
6.8s
टोकन
1,389 tok

#309 Qwen3.5-9B

none
Reached the allocated time limit (300 seconds) without receiving showcase output.
लागत
$0.000
समय
300.0s
टोकन
0 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Laguna S 2.1 5.3 7.2 44.4% 1 271.42s 6,496 59,355 151,009
Qwen3.5-9B 3.9 7.8 11.1% 1 5.60s 7,913 1,042 0

त्वरित तुलना

तुलना जोड़ी बदलें