- स्कोर
- 8.0 (+0.86 अंक)
- कुल लागत (वर्तमान कीमत)
- $0.045 · 77.0% सस्ता
- प्रतिक्रिया समय (औसत)
- 23.66s · 77.0% तेज़
सारांश
Qwen3.8 Flash Next AI BENCHY पर 7.1 स्कोर करता है और #154 पर है। इसकी reliability 9.9, pass rate 72.5%, कुल लागत ~$0.195, और औसत response time 102.66s है।
Qwen3.8 Flash Next को अलग क्या बनाता है: यह असामान्य रूप से अधिक reasoning tokens इस्तेमाल करता है, जिससे धीमे या महंगे runs समझ में आ सकते हैं।
सुझाए गए विकल्प
हम इसकी जगह यह मॉडल चुनने की सलाह देते हैं:
मॉडल विवरण
शोध की तारीख: 2026-10-04
- पैरामीटर
- 180B कुल (6B सक्रिय)
- आर्किटेक्चर
- MoE
- उपलब्धता
- वेट उपलब्ध
- लाइसेंस
- Qwen Community License 1.0
7.1
संगति
7.9
9.9
~$0.195
कुल आउटपुट टोकन
621,056
कुल इनपुट टोकन
301,749
बेंचमार्क की अनुमानित बिजली लागत
~$0.195
अस्थिर टेस्ट
6
अस्थिर टेस्ट में रनों के बीच मिले-जुले परिणाम रहे (कम से कम एक पास और एक फेल)।
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#154 Qwen3.8 Flash Next
xhigh- लागत
- ~$0.010
- समय
- 333.1s
- टोकन
- 30,654 tok
चार्ट
पहले मॉडल चुनें, फिर दूसरा मॉडल क्लिक करके साइड-बाय-साइड पेज खोलें।
स्कोर के अनुसार शीर्ष मॉडल
स्कोर vs कुल लागत
प्रतिक्रिया समय (औसत)
स्कोर vs प्रतिक्रिया समय (औसत)
कुल आउटपुट टोकन
स्कोर vs कुल आउटपुट टोकन
त्वरित तुलना
श्रेणी विवरण
| श्रेणी | स्कोर | संगति | सही परीक्षण |
|---|---|---|---|
| स्वायत्त एजेंट कार्य | 4.7 | 3.1 | |
| एंटी-एआई ट्रिक्स | 10.0 | 10.0 | |
| कोडिंग | 7.4 | 7.0 | |
| संयुक्त | 7.3 | 5.8 | |
| डेटा पार्सिंग और निष्कर्षण | 10.0 | 10.0 | |
| डोमेन-विशिष्ट | 3.5 | 4.4 | |
| Samanya Buddhimatta | 4.7 | 3.1 | |
| निर्देश पालन | 9.8 | 10.0 | |
| पहेली समाधान | 7.7 | 10.0 | |
| टूल कॉलिंग | 10.0 | 10.0 | |
| सामान्य ज्ञान | 3.0 | 10.0 |