- स्कोअर
- 9.4 (+1.46 गुण)
- एकूण खर्च (सध्याची किंमत)
- $0.183 · 59.6% स्वस्त
- प्रतिसाद वेळ (सरासरी)
- 6.24s · 20.5% वेगवान
सारांश
Qwen3.7 Max AI BENCHY वर 7.9 स्कोर करते आणि #102 वर आहे. याची reliability 9.9, pass rate 69.6%, एकूण खर्च $0.451, आणि सरासरी response time 7.85s आहे.
Qwen3.7 Max खास का आहे: हे डोमेन-विशिष्ट मध्ये सर्वाधिक उठून दिसते, जिथे त्याचा rank #2 आहे; तर कोडिंग हा सर्वात कमकुवत भाग आहे, rank #17. समान मॉडेल्सच्या तुलनेत हे लक्षणीय वेगवान आहे.
शिफारस केलेले पर्याय
त्याऐवजी यापैकी एक मॉडेल निवडण्याची शिफारस करतो:
- स्कोअर
- 9.6 (+1.65 गुण)
- एकूण खर्च (सध्याची किंमत)
- $0.460 · 1.9% महाग
- प्रतिसाद वेळ (सरासरी)
- 7.15s · 9.0% वेगवान
मॉडेलची माहिती
संशोधन दिनांक: 2026-08-12
- पॅरामीटर्स
- ~1T एकूण (~40B सक्रिय)
- आर्किटेक्चर
- MoE
- उपलब्धता
- बंद स्रोत
- परवाना
- -
सार्वजनिक पुराव्यावर आधारित सर्वोत्तम अंदाज; प्रदात्याने सर्व मूल्ये जाहीर केलेली नाहीत.
7.9
सुसंगतता
10.0
9.9
एकूण आउटपुट टोकन्स
20,670
एकूण इनपुट टोकन्स
243,553
इनपुट किंमत
$1.475 / 1M
आउटपुट किंमत
$4.425 / 1M
कॅश वाचण्याची किंमत
$0.295 / 1M
कॅश लिहिण्याची किंमत
$1.844 / 1M
कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.
अस्थिर चाचण्या
0
अस्थिर चाचण्यांत रन्समध्ये मिश्र निकाल असतात (किमान एक पास आणि एक फेल).
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#102 Qwen3.7 Max
none- खर्च
- $0.046
- वेळ
- 195.0s
- टोकन्स
- 12,171 tok
रन इतिहास
| चाचणी तारीख | स्कोअर | विश्वसनीयता | बरोबर चाचण्या | एकूण खर्च | तुलना करा |
|---|---|---|---|---|---|
| 2026-10-01 00:45 पुन्हा चाचणी | 7.9 | 9.9 | $0.451 ↓ | सध्याची रन | |
| 2026-07-16 21:33 नवीन चाचणी जोडली | 7.4 | 9.9 | $0.197 ↓ | तुलना करा | |
| 2026-06-04 13:21 नवीन चाचणी जोडली | 7.7 | 10.0 | $0.054 ↓ | तुलना करा | |
| 2026-05-21 23:54 पहिला रन | 7.9 | 10.0 | $0.101 | तुलना करा |
या रनमध्ये वेगळा बेंचमार्क सूट वापरला गेला. ऐतिहासिक बदल वाचताना सूटमधील बदल लक्षात घ्या.
रन तुलना
| रन | बेंचमार्क कव्हरेज | स्कोअर | सुसंगतता | विश्वसनीयता | बरोबर चाचण्या | अस्थिर चाचण्या | एकूण आउटपुट टोकन्स | एकूण इनपुट टोकन्स | एकूण खर्च | प्रतिसाद वेळ (सरासरी) |
|---|---|---|---|---|---|---|---|---|---|---|
| 2026-10-01 00:45 · सध्याची रन | 69/69 प्रयत्न | 7.9 | 10.0 | 9.9 | 16/23 | 0 | 20,670 | 243,553 | $0.451 | 7.85s |
| 2026-06-04 13:21 · नवीन चाचणी जोडली | 63/63 प्रयत्न | 7.7 | 10.0 | 10.0 | 14/21 | 0 | 1,994 | 37,107 | $0.054 | 1.30s |
| फरक | — | +0.2 | 0.0 | -0.1 | +2 | 0 | +18676 | +206446 | +$0.397 | +6558ms |
बेंचमार्क कव्हरेज वेगळे आहे: 69/69 प्रयत्न (लक्ष्य: प्रत्येक चाचणीसाठी 3 पुनरावृत्ती) विरुद्ध 63/63 प्रयत्न (लक्ष्य: प्रत्येक चाचणीसाठी 3 पुनरावृत्ती). एकूण मूल्ये आणि पुनरावृत्तीवर अवलंबून मेट्रिक्स थेट तुलना करता येत नाहीत.
या दोन रनमध्ये वेगवेगळे बेंचमार्क सूट वापरले गेले, त्यामुळे फरकांमध्ये मॉडेलमधील आणि सूटमधील दोन्ही बदल दिसतात.
किंमत इतिहास
OpenRouter मधील या मॉडेलचा ऐतिहासिक किंमत डेटा.
| तारीख | इनपुट किंमत | आउटपुट किंमत | कॅश वाचण्याची किंमत | कॅश लिहिण्याची किंमत |
|---|---|---|---|---|
| 2026-06-04 15:40 | $1.250 / 1M | $3.750 / 1M | लागू नाही | लागू नाही |
| 2026-08-14 12:51 | $1.475 / 1M | $4.425 / 1M | लागू नाही | लागू नाही |
| 2026-10-01 18:33 | $1.475 / 1M | $4.425 / 1M | $0.295 / 1M | $1.844 / 1M |
चार्ट्स
पहिले मॉडेल निवडा, नंतर दुसरे मॉडेल क्लिक करून बाजू-बाजूची तुलना पेज उघडा.
स्कोअरनुसार शीर्ष मॉडेल्स
स्कोअर vs एकूण खर्च
प्रतिसाद वेळ (सरासरी)
स्कोअर vs प्रतिसाद वेळ (सरासरी)
एकूण आउटपुट टोकन्स
स्कोअर vs एकूण आउटपुट टोकन्स
झटपट तुलना
श्रेणीवार तपशील
| श्रेणी | स्कोअर | सुसंगतता | बरोबर चाचण्या |
|---|---|---|---|
| स्वायत्त एजंट कार्ये | 10.0 | 10.0 | |
| अँटी-एआय युक्त्या | 6.5 | 10.0 | |
| कोडिंग | 5.5 | 10.0 | |
| संयुक्त | 6.5 | 10.0 | |
| डेटा पार्सिंग आणि निष्कर्षण | 10.0 | 10.0 | |
| डोमेन-विशिष्ट | 7.7 | 10.0 | |
| Samanya Buddhimatta | 10.0 | 10.0 | |
| सूचनांचे पालन | 10.0 | 10.0 | |
| कोडी सोडवणे | 10.0 | 10.0 | |
| टूल कॉलिंग | 10.0 | 10.0 | |
| सामान्य ज्ञान | 3.0 | 10.0 |