नेविगेशन
AI BENCHY
Advertise here

Poolside: Laguna S 2.1 vs Qwen: Qwen3.5-122B-A10B

Qwen3.5-122B-A10B average score में आगे है: 5.7 vs 5.4. Laguna S 2.1 (medium) की benchmark लागत कम है: $0.059 vs $0.247. Qwen3.5-122B-A10B तेज है: 12.92s vs 58.43s, pass rates 25.8% vs 33.3%.

अनुशंसित मॉडलQwen3.5-122B-A10BIt has the best score here (5.7), while responding about 4.5x faster than Laguna S 2.1 (medium).

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-22

मेट्रिक Laguna S 2.1 Laguna S 2.1 medium रिलीज़: 2026-07-21 निःशुल्क उपलब्ध Qwen3.5-122B-A10B Qwen3.5-122B-A10B none रिलीज़: 2026-02-24
स्कोर 5.4 5.7
रैंक #164 #148
विश्वसनीयता 9.8 10.0
संगति 8.4 9.3
सही परीक्षण
प्रति प्रयास पास दर 25.8% 33.3%
अस्थिर टेस्ट 4 2
कुल रन 66 66
प्रति परिणाम लागत 1.451 4.182
कुल लागत $0.059 $0.247
इनपुट कीमत $0.100 / 1M $0.260 / 1M
आउटपुट कीमत $0.200 / 1M $2.080 / 1M
कुल इनपुट टोकन 86,641 241,566
आउटपुट टोकन 97,298 88,458
रीजनिंग टोकन 242,297 0
प्रतिक्रिया समय (औसत) 58.43s 12.92s
प्रतिक्रिया समय (अधिकतम) 560.31s 212.63s
प्रतिक्रिया समय (कुल) 1285.48s 284.21s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#164 Laguna S 2.1

medium
लागत
$0.001
समय
4.0s
टोकन
867 tok

#148 Qwen3.5-122B-A10B

none
लागत
$0.016
समय
44.5s
टोकन
6,431 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Laguna S 2.1 5.3 7.2 44.4% 1 158.98s 7,917 93,354 106,718
Qwen3.5-122B-A10B 3.7 7.0 22.2% 1 2.77s 7,913 693 0

त्वरित तुलना

तुलना जोड़ी बदलें