- স্কোর
- 8.0 (+0.86 পয়েন্ট)
- মোট খরচ (বর্তমান মূল্য)
- $0.045 · 77.0% সস্তা
- প্রতিক্রিয়া সময় (গড়)
- 23.66s · 77.0% দ্রুত
সারাংশ
Qwen3.8 Flash Next AI BENCHY-তে 7.1 স্কোর করে এবং #154 স্থানে আছে। এর reliability 9.9, pass rate 72.5%, মোট খরচ ~$0.195, এবং গড় response time 102.66s.
Qwen3.8 Flash Next কে আলাদা করে যা: এটি অস্বাভাবিকভাবে বেশি reasoning tokens ব্যবহার করে, যা ধীর বা বেশি খরচের runs ব্যাখ্যা করতে পারে।
প্রস্তাবিত বিকল্প
এর বদলে এই মডেল বেছে নেওয়ার পরামর্শ দিই:
মডেলের তথ্য
গবেষণার তারিখ: 2026-10-04
- প্যারামিটার
- 180B মোট (6B সক্রিয়)
- আর্কিটেকচার
- MoE
- উপলভ্যতা
- ওজন উপলভ্য
- লাইসেন্স
- Qwen Community License 1.0
7.1
ধারাবাহিকতা
7.9
~$0.195
মোট আউটপুট টোকেন
621,056
মোট ইনপুট টোকেন
301,749
বেঞ্চমার্কের আনুমানিক বিদ্যুৎ খরচ
~$0.195
অস্থির টেস্ট
6
অস্থির টেস্টে রানভেদে মিশ্র ফল হয়েছে (কমপক্ষে একটি পাস এবং একটি ফেল)।
102.66s
প্রতিক্রিয়া সময় (সর্বোচ্চ): 674.08s
প্রতিক্রিয়া সময় (মোট): 2361.10s
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#154 Qwen3.8 Flash Next
xhigh- খরচ
- ~$0.010
- সময়
- 333.1s
- টোকেন
- 30,654 tok
চার্ট
প্রথম মডেলটি নির্বাচন করুন, তারপর দ্বিতীয় মডেলে ক্লিক করে পাশাপাশি তুলনা পৃষ্ঠা খুলুন।
স্কোর অনুযায়ী শীর্ষ মডেল
স্কোর vs মোট খরচ
প্রতিক্রিয়া সময় (গড়)
স্কোর vs প্রতিক্রিয়া সময় (গড়)
মোট আউটপুট টোকেন
স্কোর vs মোট আউটপুট টোকেন
দ্রুত তুলনা
বিভাগভিত্তিক বিশ্লেষণ
| বিভাগ | স্কোর | ধারাবাহিকতা | সঠিক টেস্ট |
|---|---|---|---|
| স্বায়ত্তশাসিত এজেন্টের কাজ | 4.7 | 3.1 | |
| অ্যান্টি-এআই কৌশল | 10.0 | 10.0 | |
| কোডিং | 7.4 | 7.0 | |
| সমন্বিত | 7.3 | 5.8 | |
| ডেটা পার্সিং ও নিষ্কাশন | 10.0 | 10.0 | |
| ডোমেইন-নির্দিষ্ট | 3.5 | 4.4 | |
| Sadharon Buddhimotta | 4.7 | 3.1 | |
| নির্দেশনা অনুসরণ | 9.8 | 10.0 | |
| ধাঁধা সমাধান | 7.7 | 10.0 | |
| টুল কলিং | 10.0 | 10.0 | |
| সাধারণ জ্ঞান | 3.0 | 10.0 |