- स्कोअर
- 8.3 (+3.37 गुण)
- एकूण खर्च (सध्याची किंमत)
- $0.047 · 29.1% स्वस्त
- प्रतिसाद वेळ (सरासरी)
- 18.07s · 8.4% वेगवान
सारांश
Qwen3 Coder Next AI BENCHY वर 4.9 स्कोर करते आणि #312 वर आहे. याची reliability 10.0, pass rate 24.6%, एकूण खर्च $0.067, आणि सरासरी response time 19.73s आहे.
Qwen3 Coder Next खास का आहे: हे Samanya Buddhimatta मध्ये सर्वाधिक उठून दिसते, जिथे त्याचा rank #1 आहे; तर कोडी सोडवणे हा सर्वात कमकुवत भाग आहे, rank #12.
शिफारस केलेले पर्याय
त्याऐवजी यापैकी एक मॉडेल निवडण्याची शिफारस करतो:
- स्कोअर
- 5.2 (+0.29 गुण)
- एकूण खर्च (सध्याची किंमत)
- $0.004 · 94.8% स्वस्त
- प्रतिसाद वेळ (सरासरी)
- 3.40s · 82.8% वेगवान
- स्कोअर
- 5.0 (+0.07 गुण)
- एकूण खर्च (सध्याची किंमत)
- $0.000 · 100.0% स्वस्त
- प्रतिसाद वेळ (सरासरी)
- 5.36s · 72.8% वेगवान
मॉडेलची माहिती
संशोधन दिनांक: 2026-08-12
- पॅरामीटर्स
- 80B एकूण (3B सक्रिय)
- आर्किटेक्चर
- MoE
- उपलब्धता
- मुक्त स्रोत
- परवाना
- Apache-2.0
4.9
सुसंगतता
9.7
10.0
एकूण आउटपुट टोकन्स
45,168
एकूण इनपुट टोकन्स
250,329
इनपुट किंमत
$0.120 / 1M
आउटपुट किंमत
$0.800 / 1M
कॅश वाचण्याची किंमत
$0.070 / 1M
कॅश लिहिण्याची किंमत
लागू नाही
कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.
अस्थिर चाचण्या
1
अस्थिर चाचण्यांत रन्समध्ये मिश्र निकाल असतात (किमान एक पास आणि एक फेल).
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#312 Qwen3 Coder Next
none- खर्च
- $0.058
- वेळ
- 246.3s
- टोकन्स
- 64,126 tok
रन इतिहास
| चाचणी तारीख | स्कोअर | विश्वसनीयता | बरोबर चाचण्या | एकूण खर्च | तुलना करा |
|---|---|---|---|---|---|
| 2026-10-01 00:24 पुन्हा चाचणी | 4.9 | 10.0 | $0.067 ↑ | सध्याची रन | |
| 2026-07-16 21:14 नवीन चाचणी जोडली | 5.1 | 10.0 | $0.025 ↓ | तुलना करा | |
| 2026-06-04 13:09 नवीन चाचणी जोडली | 4.9 | 10.0 | $0.009 ↓ | तुलना करा | |
| 2026-05-21 23:44 सूट बदलला | 5.1 | 10.0 | $0.008 | तुलना करा | |
| 2026-04-14 00:56 पहिली नोंदलेली रन | 5.1 | लागू नाही | $0.008 | तुलना करा |
या रनमध्ये वेगळा बेंचमार्क सूट वापरला गेला. ऐतिहासिक बदल वाचताना सूटमधील बदल लक्षात घ्या.
रन तुलना
| रन | बेंचमार्क कव्हरेज | स्कोअर | सुसंगतता | विश्वसनीयता | बरोबर चाचण्या | अस्थिर चाचण्या | एकूण आउटपुट टोकन्स | एकूण इनपुट टोकन्स | एकूण खर्च | प्रतिसाद वेळ (सरासरी) |
|---|---|---|---|---|---|---|---|---|---|---|
| 2026-10-01 00:24 · सध्याची रन | 69/69 प्रयत्न | 4.9 | 9.7 | 10.0 | 5/23 | 1 | 45,168 | 250,329 | $0.067 | 19.73s |
| 2026-07-16 21:14 · नवीन चाचणी जोडली | 66/66 प्रयत्न | 5.1 | 9.7 | 10.0 | 5/22 | 1 | 11,808 | 134,218 | $0.025 | 9.12s |
| फरक | — | -0.2 | 0.0 | 0.0 | 0 | 0 | +33360 | +116111 | +$0.042 | +10606ms |
बेंचमार्क कव्हरेज वेगळे आहे: 69/69 प्रयत्न (लक्ष्य: प्रत्येक चाचणीसाठी 3 पुनरावृत्ती) विरुद्ध 66/66 प्रयत्न (लक्ष्य: प्रत्येक चाचणीसाठी 3 पुनरावृत्ती). एकूण मूल्ये आणि पुनरावृत्तीवर अवलंबून मेट्रिक्स थेट तुलना करता येत नाहीत.
या दोन रनमध्ये वेगवेगळे बेंचमार्क सूट वापरले गेले, त्यामुळे फरकांमध्ये मॉडेलमधील आणि सूटमधील दोन्ही बदल दिसतात.
किंमत इतिहास
OpenRouter मधील या मॉडेलचा ऐतिहासिक किंमत डेटा.
| तारीख | इनपुट किंमत | आउटपुट किंमत | कॅश वाचण्याची किंमत | कॅश लिहिण्याची किंमत |
|---|---|---|---|---|
| 2026-06-04 15:40 | $0.110 / 1M | $0.800 / 1M | लागू नाही | लागू नाही |
| 2026-08-14 12:51 | $0.120 / 1M | $0.800 / 1M | लागू नाही | लागू नाही |
| 2026-10-01 18:33 | $0.120 / 1M | $0.800 / 1M | $0.070 / 1M | लागू नाही |
चार्ट्स
पहिले मॉडेल निवडा, नंतर दुसरे मॉडेल क्लिक करून बाजू-बाजूची तुलना पेज उघडा.
स्कोअरनुसार शीर्ष मॉडेल्स
स्कोअर vs एकूण खर्च
प्रतिसाद वेळ (सरासरी)
स्कोअर vs प्रतिसाद वेळ (सरासरी)
एकूण आउटपुट टोकन्स
स्कोअर vs एकूण आउटपुट टोकन्स
झटपट तुलना
श्रेणीवार तपशील
| श्रेणी | स्कोअर | सुसंगतता | बरोबर चाचण्या |
|---|---|---|---|
| स्वायत्त एजंट कार्ये | 3.9 | 9.6 | |
| अँटी-एआय युक्त्या | 3.6 | 10.0 | |
| कोडिंग | 4.6 | 7.9 | |
| संयुक्त | 3.0 | 10.0 | |
| डेटा पार्सिंग आणि निष्कर्षण | 6.5 | 10.0 | |
| डोमेन-विशिष्ट | 5.3 | 10.0 | |
| Samanya Buddhimatta | 10.0 | 10.0 | |
| सूचनांचे पालन | 6.3 | 10.0 | |
| कोडी सोडवणे | 3.0 | 10.0 | |
| टूल कॉलिंग | 10.0 | 10.0 | |
| सामान्य ज्ञान | 3.0 | 10.0 |