- स्कोअर
- 8.3 (+3.61 गुण)
- एकूण खर्च (सध्याची किंमत)
- $0.047 · 33.0% स्वस्त
- प्रतिसाद वेळ (सरासरी)
- 18.07s · 6.4% संथ
सारांश
Qwen3 Coder Next AI BENCHY वर 4.7 स्कोर करते आणि #331 वर आहे. याची reliability 10.0, pass rate 24.6%, एकूण खर्च $0.071, आणि सरासरी response time 16.97s आहे.
Qwen3 Coder Next खास का आहे: हे Samanya Buddhimatta मध्ये सर्वाधिक उठून दिसते, जिथे त्याचा rank #1 आहे; तर कोडी सोडवणे हा सर्वात कमकुवत भाग आहे, rank #10.
शिफारस केलेले पर्याय
त्याऐवजी यापैकी एक मॉडेल निवडण्याची शिफारस करतो:
- स्कोअर
- 5.2 (+0.53 गुण)
- एकूण खर्च (सध्याची किंमत)
- $0.004 · 95.1% स्वस्त
- प्रतिसाद वेळ (सरासरी)
- 3.40s · 80.0% वेगवान
- स्कोअर
- 5.0 (+0.31 गुण)
- एकूण खर्च (सध्याची किंमत)
- $0.000 · 100.0% स्वस्त
- प्रतिसाद वेळ (सरासरी)
- 5.36s · 68.4% वेगवान
मॉडेलची माहिती
संशोधन दिनांक: 2026-08-12
- पॅरामीटर्स
- 80B एकूण (3B सक्रिय)
- आर्किटेक्चर
- MoE
- उपलब्धता
- मुक्त स्रोत
- परवाना
- Apache-2.0
4.7
सुसंगतता
8.7
10.0
एकूण आउटपुट टोकन्स
40,395
एकूण इनपुट टोकन्स
311,647
इनपुट किंमत
$0.120 / 1M
आउटपुट किंमत
$0.800 / 1M
कॅश वाचण्याची किंमत
$0.070 / 1M
कॅश लिहिण्याची किंमत
लागू नाही
कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.
अस्थिर चाचण्या
4
अस्थिर चाचण्यांत रन्समध्ये मिश्र निकाल असतात (किमान एक पास आणि एक फेल).
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#331 Qwen3 Coder Next
medium- खर्च
- $0.000
- वेळ
- 300.0s
- टोकन्स
- 0 tok
रन इतिहास
| चाचणी तारीख | स्कोअर | विश्वसनीयता | बरोबर चाचण्या | एकूण खर्च | तुलना करा |
|---|---|---|---|---|---|
| 2026-10-01 00:26 पुन्हा चाचणी | 4.7 | 10.0 | $0.071 ↑ | सध्याची रन | |
| 2026-07-16 21:16 नवीन चाचणी जोडली | 4.7 | 10.0 | $0.032 ↓ | तुलना करा | |
| 2026-06-04 13:09 नवीन चाचणी जोडली | 4.6 | 10.0 | $0.008 ↓ | तुलना करा | |
| 2026-05-21 23:45 सूट बदलला | 4.7 | 10.0 | $0.008 | तुलना करा | |
| 2026-04-14 00:56 पहिली नोंदलेली रन | 4.7 | लागू नाही | $0.008 | तुलना करा |
या रनमध्ये वेगळा बेंचमार्क सूट वापरला गेला. ऐतिहासिक बदल वाचताना सूटमधील बदल लक्षात घ्या.
रन तुलना
| रन | बेंचमार्क कव्हरेज | स्कोअर | सुसंगतता | विश्वसनीयता | बरोबर चाचण्या | अस्थिर चाचण्या | एकूण आउटपुट टोकन्स | एकूण इनपुट टोकन्स | एकूण खर्च | प्रतिसाद वेळ (सरासरी) |
|---|---|---|---|---|---|---|---|---|---|---|
| 2026-10-01 00:26 · सध्याची रन | 69/69 प्रयत्न | 4.7 | 8.7 | 10.0 | 3/23 | 4 | 40,395 | 311,647 | $0.071 | 16.97s |
| 2026-07-16 21:16 · नवीन चाचणी जोडली | 66/66 प्रयत्न | 4.7 | 9.0 | 10.0 | 4/22 | 3 | 19,069 | 148,194 | $0.032 | 9.61s |
| फरक | — | 0.0 | -0.3 | 0.0 | -1 | +1 | +21326 | +163453 | +$0.039 | +7369ms |
बेंचमार्क कव्हरेज वेगळे आहे: 69/69 प्रयत्न (लक्ष्य: प्रत्येक चाचणीसाठी 3 पुनरावृत्ती) विरुद्ध 66/66 प्रयत्न (लक्ष्य: प्रत्येक चाचणीसाठी 3 पुनरावृत्ती). एकूण मूल्ये आणि पुनरावृत्तीवर अवलंबून मेट्रिक्स थेट तुलना करता येत नाहीत.
या दोन रनमध्ये वेगवेगळे बेंचमार्क सूट वापरले गेले, त्यामुळे फरकांमध्ये मॉडेलमधील आणि सूटमधील दोन्ही बदल दिसतात.
किंमत इतिहास
OpenRouter मधील या मॉडेलचा ऐतिहासिक किंमत डेटा.
| तारीख | इनपुट किंमत | आउटपुट किंमत | कॅश वाचण्याची किंमत | कॅश लिहिण्याची किंमत |
|---|---|---|---|---|
| 2026-06-04 15:40 | $0.110 / 1M | $0.800 / 1M | लागू नाही | लागू नाही |
| 2026-08-14 12:51 | $0.120 / 1M | $0.800 / 1M | लागू नाही | लागू नाही |
| 2026-10-01 18:33 | $0.120 / 1M | $0.800 / 1M | $0.070 / 1M | लागू नाही |
चार्ट्स
पहिले मॉडेल निवडा, नंतर दुसरे मॉडेल क्लिक करून बाजू-बाजूची तुलना पेज उघडा.
स्कोअरनुसार शीर्ष मॉडेल्स
स्कोअर vs एकूण खर्च
प्रतिसाद वेळ (सरासरी)
स्कोअर vs प्रतिसाद वेळ (सरासरी)
एकूण आउटपुट टोकन्स
स्कोअर vs एकूण आउटपुट टोकन्स
झटपट तुलना
श्रेणीवार तपशील
| श्रेणी | स्कोअर | सुसंगतता | बरोबर चाचण्या |
|---|---|---|---|
| स्वायत्त एजंट कार्ये | 5.0 | 10.0 | |
| अँटी-एआय युक्त्या | 3.5 | 8.1 | |
| कोडिंग | 3.7 | 7.2 | |
| संयुक्त | 3.0 | 10.0 | |
| डेटा पार्सिंग आणि निष्कर्षण | 6.5 | 10.0 | |
| डोमेन-विशिष्ट | 3.6 | 7.2 | |
| Samanya Buddhimatta | 6.3 | 3.4 | |
| सूचनांचे पालन | 6.3 | 10.0 | |
| कोडी सोडवणे | 3.0 | 10.0 | |
| टूल कॉलिंग | 10.0 | 10.0 | |
| सामान्य ज्ञान | 3.0 | 10.0 |