नेविगेशन
AI BENCHY
Advertise here

Poolside: Laguna S 2.1 vs Qwen: Qwen3.5-9B

Laguna S 2.1 average score में आगे है: 4.5 vs 3.8. Laguna S 2.1 की benchmark लागत कम है: $0.025 vs $0.036. Laguna S 2.1 तेज है: 11.67s vs 82.24s, pass rates 15.2% vs 25.8%.

अनुशंसित मॉडलLaguna S 2.1It has the best score here (4.5), while responding about 7.0x faster than Qwen3.5-9B (medium).

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-22

मेट्रिक Laguna S 2.1 Laguna S 2.1 none रिलीज़: 2026-07-21 निःशुल्क उपलब्ध Qwen3.5-9B Qwen3.5-9B medium रिलीज़: 2026-03-02
स्कोर 4.5 3.8
रैंक #200 #214
विश्वसनीयता 10.0 5.0
संगति 8.8 8.1
सही परीक्षण
प्रति प्रयास पास दर 15.2% 25.8%
अस्थिर टेस्ट 3 5
कुल रन 66 66
प्रति परिणाम लागत 1.205 1.187
कुल लागत $0.025 $0.036
इनपुट कीमत $0.100 / 1M $0.100 / 1M
आउटपुट कीमत $0.200 / 1M $0.150 / 1M
कुल इनपुट टोकन 125,598 17,070
आउटपुट टोकन 57,634 29,045
रीजनिंग टोकन 0 209,516
प्रतिक्रिया समय (औसत) 11.67s 82.24s
प्रतिक्रिया समय (अधिकतम) 200.52s 226.38s
प्रतिक्रिया समय (कुल) 256.80s 1315.88s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#200 Laguna S 2.1

none
लागत
$0.001
समय
7.6s
टोकन
1,345 tok

#214 Qwen3.5-9B

medium
लागत
$0.001
समय
35.9s
टोकन
3,030 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Laguna S 2.1 3.4 9.7 0.0% 0 550ms 7,917 424 0
Qwen3.5-9B 2.9 10.0 0.0% 0 100.88s 2,396 7,890 41,129

त्वरित तुलना

तुलना जोड़ी बदलें