नेविगेशन
Advertise here

Laguna S 2.1 vs Qwen3.5-9B (medium)

Laguna S 2.1 average score में आगे है: 4.5 vs 3.8. Laguna S 2.1 की benchmark लागत कम है: $0.022 vs $0.062. Laguna S 2.1 तेज है: 11.67s vs 107.51s, pass rates 15.2% vs 25.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-23

तुलना किए गए मॉडल

रैंक
#326
कुल आउटपुट टोकन
57,634
प्रतिक्रिया समय (औसत)
11.67s
कुल लागत
$0.022
रैंक
#346
कुल आउटपुट टोकन
413,442
प्रतिक्रिया समय (औसत)
107.51s
कुल लागत
$0.062
अनुशंसित मॉडल Laguna S 2.1

It has the best score here (4.5), while costing about 2.9x less than Qwen3.5-9B (medium).

विस्तृत तुलना

मेट्रिक Laguna S 2.1 Laguna S 2.1 none रिलीज़: 2026-07-21 निःशुल्क उपलब्ध Qwen3.5-9B Qwen3.5-9B medium रिलीज़: 2026-03-02
स्कोर 4.5 3.8
रैंक #326 #346
विश्वसनीयता 10.0 6.0
संगति 8.8 8.1
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 15.2% 25.8%
अस्थिर टेस्ट 3 5
कुल रन 66 66
प्रति परिणाम लागत 1.205 2.061
कुल लागत $0.022 $0.062
इनपुट कीमत $0.090 / 1M $0.100 / 1M
आउटपुट कीमत $0.180 / 1M $0.150 / 1M
कुल इनपुट टोकन 125,604 17,195
आउटपुट टोकन 57,634 46,735
रीजनिंग टोकन 0 366,707
प्रतिक्रिया समय (औसत) 11.67s 107.51s
प्रतिक्रिया समय (अधिकतम) 200.52s 569.97s
प्रतिक्रिया समय (कुल) 256.71s 1720.15s
पैरामीटर 118B कुल (8B सक्रिय) 9B
उपलब्धता वेट उपलब्ध मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#326 Laguna S 2.1

none
लागत
$0.001
समय
7.6s
टोकन
1,345 tok

#346 Qwen3.5-9B

medium
लागत
$0.001
समय
35.9s
टोकन
3,030 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Laguna S 2.1 3.4 9.7 0.0% 0 550ms 7,917 424 0
Qwen3.5-9B 2.9 10.0 0.0% 0 100.88s 2,396 7,890 41,129

त्वरित तुलना

तुलना जोड़ी बदलें