नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Poolside: Laguna S 2.1 vs Qwen: Qwen3 Coder Next

Laguna S 2.1 (medium) average score मध्ये पुढे आहे: 5.4 vs 5.1. Qwen3 Coder Next चा benchmark खर्च कमी आहे: $0.025 vs $0.059. Qwen3 Coder Next वेगवान आहे: 9.12s vs 58.43s, pass rates 25.8% vs 25.8%.

शिफारस केलेले मॉडेलQwen3 Coder NextIts score stays close to the best score here (5.1 vs 5.4), while costing about 2.4x less than Laguna S 2.1 (medium).

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-22

मेट्रिक Laguna S 2.1 Laguna S 2.1 medium प्रकाशन: 2026-07-21 मोफत उपलब्ध Qwen3 Coder Next Qwen3 Coder Next none प्रकाशन: 2026-02-03
स्कोअर 5.4 5.1
क्रमांक #164 #174
विश्वसनीयता 9.8 10.0
सुसंगतता 8.4 9.7
बरोबर चाचण्या
प्रति प्रयत्न पास दर 25.8% 25.8%
अस्थिर चाचण्या 4 1
एकूण रन 66 66
प्रति निकाल खर्च 1.451 0.488
एकूण खर्च $0.059 $0.025
इनपुट किंमत $0.100 / 1M $0.110 / 1M
आउटपुट किंमत $0.200 / 1M $0.800 / 1M
एकूण इनपुट टोकन्स 86,641 134,218
आउटपुट टोकन्स 97,298 11,808
रिझनिंग टोकन्स 242,297 0
प्रतिसाद वेळ (सरासरी) 58.43s 9.12s
प्रतिसाद वेळ (कमाल) 560.31s 45.14s
प्रतिसाद वेळ (एकूण) 1285.48s 145.94s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#164 Laguna S 2.1

medium
खर्च
$0.001
वेळ
4.0s
टोकन्स
867 tok

#174 Qwen3 Coder Next

none
अवैध SVG
खर्च
$0.058
वेळ
246.3s
टोकन्स
64,126 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Laguna S 2.1 5.3 7.2 44.4% 1 158.98s 7,917 93,354 106,718
Qwen3 Coder Next 4.6 7.9 22.2% 1 2.22s 7,442 621 0

झटपट तुलना

तुलना जोडी बदला