नेव्हिगेशन
AI BENCHY
Advertise here

Poolside: Laguna S 2.1 vs Qwen: Qwen3.5-122B-A10B

Qwen3.5-122B-A10B average score मध्ये पुढे आहे: 5.7 vs 5.4. Laguna S 2.1 (medium) चा benchmark खर्च कमी आहे: $0.059 vs $0.247. Qwen3.5-122B-A10B वेगवान आहे: 12.92s vs 58.43s, pass rates 25.8% vs 33.3%.

शिफारस केलेले मॉडेलQwen3.5-122B-A10BIt has the best score here (5.7), while responding about 4.5x faster than Laguna S 2.1 (medium).

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-22

मेट्रिक Laguna S 2.1 Laguna S 2.1 medium प्रकाशन: 2026-07-21 मोफत उपलब्ध Qwen3.5-122B-A10B Qwen3.5-122B-A10B none प्रकाशन: 2026-02-24
स्कोअर 5.4 5.7
क्रमांक #164 #148
विश्वसनीयता 9.8 10.0
सुसंगतता 8.4 9.3
बरोबर चाचण्या
प्रति प्रयत्न पास दर 25.8% 33.3%
अस्थिर चाचण्या 4 2
एकूण रन 66 66
प्रति निकाल खर्च 1.451 4.182
एकूण खर्च $0.059 $0.247
इनपुट किंमत $0.100 / 1M $0.260 / 1M
आउटपुट किंमत $0.200 / 1M $2.080 / 1M
एकूण इनपुट टोकन्स 86,641 241,566
आउटपुट टोकन्स 97,298 88,458
रिझनिंग टोकन्स 242,297 0
प्रतिसाद वेळ (सरासरी) 58.43s 12.92s
प्रतिसाद वेळ (कमाल) 560.31s 212.63s
प्रतिसाद वेळ (एकूण) 1285.48s 284.21s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#164 Laguna S 2.1

medium
खर्च
$0.001
वेळ
4.0s
टोकन्स
867 tok

#148 Qwen3.5-122B-A10B

none
खर्च
$0.016
वेळ
44.5s
टोकन्स
6,431 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Laguna S 2.1 5.3 7.2 44.4% 1 158.98s 7,917 93,354 106,718
Qwen3.5-122B-A10B 3.7 7.0 22.2% 1 2.77s 7,913 693 0

झटपट तुलना

तुलना जोडी बदला