नेविगेशन
AI BENCHY
Advertise here

Laguna S 2.1 (low) vs Qwen3.5-9B

Qwen3.5-9B average score में आगे है: 5.1 vs 5.0. Qwen3.5-9B की benchmark लागत कम है: $0.021 vs $0.082. Qwen3.5-9B तेज है: 19.19s vs 85.34s, pass rates 22.7% vs 19.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-04

रैंक
#266
कुल आउटपुट टोकन
451,708
प्रतिक्रिया समय (औसत)
85.34s
कुल लागत
$0.082
रैंक
#261
कुल आउटपुट टोकन
37,484
प्रतिक्रिया समय (औसत)
19.19s
कुल लागत
$0.021
अनुशंसित मॉडल Qwen3.5-9B

It has the best score here (5.1), while costing about 4.1x less than Laguna S 2.1 (low).

विस्तृत तुलना

मेट्रिक Laguna S 2.1 Laguna S 2.1 low रिलीज़: 2026-07-21 निःशुल्क उपलब्ध Qwen3.5-9B Qwen3.5-9B none रिलीज़: 2026-03-02
स्कोर 5.0 5.1
रैंक #266 #261
विश्वसनीयता 10.0 10.0
संगति 8.0 9.7
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 22.7% 19.7%
अस्थिर टेस्ट 5 1
कुल रन 66 66
प्रति परिणाम लागत 3.022 0.490
कुल लागत $0.082 $0.021
इनपुट कीमत $0.090 / 1M $0.100 / 1M
आउटपुट कीमत $0.180 / 1M $0.150 / 1M
कुल इनपुट टोकन 118,752 144,416
आउटपुट टोकन 67,823 37,484
रीजनिंग टोकन 383,885 0
प्रतिक्रिया समय (औसत) 85.34s 19.19s
प्रतिक्रिया समय (अधिकतम) 814.73s 382.06s
प्रतिक्रिया समय (कुल) 1877.49s 422.25s
पैरामीटर 118B कुल (8B सक्रिय) 9B
उपलब्धता वेट उपलब्ध मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#266 Laguna S 2.1

low
लागत
$0.001
समय
6.6s
टोकन
1,314 tok

#261 Qwen3.5-9B

none
Reached the allocated time limit (300 seconds) without receiving showcase output.
लागत
$0.000
समय
300.0s
टोकन
0 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Laguna S 2.1 3.8 7.1 22.2% 1 167.51s 7,917 58,111 119,138
Qwen3.5-9B 3.9 7.8 11.1% 1 5.60s 7,913 1,042 0

त्वरित तुलना

तुलना जोड़ी बदलें