नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Poolside: Laguna S 2.1 vs Qwen: Qwen3 Coder Next

Qwen3 Coder Next average score में आगे है: 5.1 vs 5.0. Qwen3 Coder Next की benchmark लागत कम है: $0.025 vs $0.091. Qwen3 Coder Next तेज है: 9.12s vs 85.35s, pass rates 25.8% vs 25.8%.

अनुशंसित मॉडलQwen3 Coder NextIt has the best score here (5.1), while costing about 3.7x less than Laguna S 2.1 (low).

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-22

मेट्रिक Laguna S 2.1 Laguna S 2.1 low रिलीज़: 2026-07-21 निःशुल्क उपलब्ध Qwen3 Coder Next Qwen3 Coder Next none रिलीज़: 2026-02-03
स्कोर 5.0 5.1
रैंक #181 #174
विश्वसनीयता 9.9 10.0
संगति 7.8 9.7
सही परीक्षण
प्रति प्रयास पास दर 25.8% 25.8%
अस्थिर टेस्ट 6 1
कुल रन 66 66
प्रति परिणाम लागत 3.022 0.488
कुल लागत $0.091 $0.025
इनपुट कीमत $0.100 / 1M $0.110 / 1M
आउटपुट कीमत $0.200 / 1M $0.800 / 1M
कुल इनपुट टोकन 118,746 134,218
आउटपुट टोकन 67,823 11,808
रीजनिंग टोकन 383,885 0
प्रतिक्रिया समय (औसत) 85.35s 9.12s
प्रतिक्रिया समय (अधिकतम) 814.73s 45.14s
प्रतिक्रिया समय (कुल) 1877.64s 145.94s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#181 Laguna S 2.1

low
लागत
$0.001
समय
6.6s
टोकन
1,314 tok

#174 Qwen3 Coder Next

none
अमान्य SVG
लागत
$0.058
समय
246.3s
टोकन
64,126 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Laguna S 2.1 3.8 7.1 22.2% 1 167.51s 7,917 58,111 119,138
Qwen3 Coder Next 4.6 7.9 22.2% 1 2.22s 7,442 621 0

त्वरित तुलना

तुलना जोड़ी बदलें