Advertise here
#178

Qwen3 Coder Next

Qwen प्रकाशन: 2026-02-03 चाचणी तारीख: 2026-07-16 21:16 qwen/qwen3-coder-next::medium
80B एकूण (3B सक्रिय)MoEमुक्त स्रोत
(medium) (none)

सारांश

Qwen3 Coder Next AI BENCHY वर 4.7 स्कोर करते आणि #178 वर आहे. याची reliability 10.0, pass rate 27.3%, एकूण खर्च $0.032, आणि सरासरी response time 9.61s आहे.

Qwen3 Coder Next खास का आहे: हे डोमेन-विशिष्ट मध्ये सर्वाधिक उठून दिसते, जिथे त्याचा rank #2 आहे; तर कोडी सोडवणे हा सर्वात कमकुवत भाग आहे, rank #18. या score range साठी एकूण benchmark खर्च असामान्यपणे कमी आहे.

मॉडेलची माहिती

संशोधन दिनांक: 2026-08-12

जाहीर केलेले
पॅरामीटर्स
80B एकूण (3B सक्रिय)
आर्किटेक्चर
MoE
उपलब्धता
मुक्त स्रोत
परवाना
Apache-2.0

सुसंगतता

9.0

एकूण खर्च (सध्याची किंमत)

$0.032 ↓ -0.5%

या किमतीवर चाचणी केली: $0.032

एकूण आउटपुट टोकन्स

19,069

एकूण इनपुट टोकन्स

148,194

इनपुट किंमत

$0.110 / 1M

आउटपुट किंमत

$0.800 / 1M

कॅश वाचण्याची किंमत

लागू नाही

कॅश लिहिण्याची किंमत

लागू नाही

कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.

बरोबर चाचण्या

चुकीच्या चाचण्या: 18

प्रति प्रयत्न पास दर: 27.3%

अस्थिर चाचण्या

3

अस्थिर चाचण्यांत रन्समध्ये मिश्र निकाल असतात (किमान एक पास आणि एक फेल).

प्रतिसाद वेळ (सरासरी)

9.61s

प्रतिसाद वेळ (कमाल): 81.80s

प्रतिसाद वेळ (एकूण): 153.69s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#178 Qwen3 Coder Next

medium
Reached the allocated time limit (300 seconds) without receiving showcase output.
खर्च
$0.000
वेळ
300.0s
टोकन्स
0 tok

रन इतिहास

चाचणी तारीख स्कोअर विश्वसनीयता बरोबर चाचण्या एकूण खर्च तुलना करा
2026-08-14 01:38 पुन्हा चाचणी 4.6 10.0 $0.034 ↑ तुलना करा
2026-07-16 21:16 नवीन चाचणी जोडली 4.7 10.0 $0.032 ↓ सध्याची रन
2026-06-04 13:09 नवीन चाचणी जोडली 4.6 10.0 $0.008 ↓ तुलना करा
2026-05-21 23:45 सूट बदलला 4.7 10.0 $0.008 तुलना करा
2026-04-14 00:56 पहिली नोंदलेली रन 4.7 लागू नाही $0.008 तुलना करा

या रनमध्ये वेगळा बेंचमार्क सूट वापरला गेला. ऐतिहासिक बदल वाचताना सूटमधील बदल लक्षात घ्या.

रन तुलना

रनबेंचमार्क कव्हरेजस्कोअरसुसंगतताविश्वसनीयताबरोबर चाचण्याअस्थिर चाचण्याएकूण आउटपुट टोकन्सएकूण इनपुट टोकन्सएकूण खर्चप्रतिसाद वेळ (सरासरी)
2026-07-16 21:16 · नवीन चाचणी जोडली66/66 प्रयत्न4.79.010.04/22319,069148,194$0.0329.61s
2026-05-21 23:45 · सूट बदलला60/60 प्रयत्न4.78.910.04/2033,2800$0.0089.29s
फरक—0.0+0.10.000+15789+148194+$0.024+316ms

बेंचमार्क कव्हरेज वेगळे आहे: 66/66 प्रयत्न (लक्ष्य: प्रत्येक चाचणीसाठी 3 पुनरावृत्ती) विरुद्ध 60/60 प्रयत्न (लक्ष्य: प्रत्येक चाचणीसाठी 3 पुनरावृत्ती). एकूण मूल्ये आणि पुनरावृत्तीवर अवलंबून मेट्रिक्स थेट तुलना करता येत नाहीत.

या दोन रनमध्ये वेगवेगळे बेंचमार्क सूट वापरले गेले, त्यामुळे फरकांमध्ये मॉडेलमधील आणि सूटमधील दोन्ही बदल दिसतात.

किंमत इतिहास

OpenRouter मधील या मॉडेलचा ऐतिहासिक किंमत डेटा.

तारीख इनपुट किंमत आउटपुट किंमत कॅश वाचण्याची किंमत कॅश लिहिण्याची किंमत
2026-06-04 15:40 $0.110 / 1M $0.800 / 1M लागू नाही लागू नाही

चार्ट्स

पहिले मॉडेल निवडा, नंतर दुसरे मॉडेल क्लिक करून बाजू-बाजूची तुलना पेज उघडा.

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

झटपट तुलना

श्रेणीवार तपशील

श्रेणी स्कोअर सुसंगतता बरोबर चाचण्या
अँटी-एआय युक्त्या 3.5 8.1
कोडिंग 3.7 7.2
संयुक्त 3.0 10.0
डेटा पार्सिंग आणि निष्कर्षण 6.5 10.0
डोमेन-विशिष्ट 5.3 10.0
Samanya Buddhimatta 6.3 3.4
सूचनांचे पालन 6.3 10.0
कोडी सोडवणे 3.0 10.0
टूल कॉलिंग 10.0 10.0
सामान्य ज्ञान 3.0 10.0

तुलना केलेली मॉडेल्स