#138 Qwen3 Coder Next
none- খরচ
- $0.058
- সময়
- 246.3s
- টোকেন
- 64,126 tok
সারাংশ
Qwen3 Coder Next AI BENCHY-তে 4.9 স্কোর করে এবং #138 স্থানে আছে। এর reliability 10.0, pass rate 27.0%, মোট খরচ $0.009, এবং গড় response time 8.62s.
Qwen3 Coder Next কে আলাদা করে যা: এটি ডোমেইন-নির্দিষ্ট-তে সবচেয়ে ভালোভাবে নজর কাড়ে, যেখানে এর rank #4; আর সমন্বিত এর দুর্বলতম ক্ষেত্র, rank #18. এই score range-এর জন্য মোট benchmark খরচ অস্বাভাবিকভাবে কম। একই ধরনের মডেলের তুলনায় এটি লক্ষণীয়ভাবে দ্রুত।
গবেষণার তারিখ: 2026-08-12
4.9
ধারাবাহিকতা
9.7
10.0
মোট আউটপুট টোকেন
3,584
মোট ইনপুট টোকেন
47,507
ইনপুট মূল্য
$0.110 / 1M
আউটপুট মূল্য
$0.800 / 1M
ক্যাশ পড়ার মূল্য
প্রযোজ্য নয়
ক্যাশ লেখার মূল্য
প্রযোজ্য নয়
ক্যাশের মূল্য ইনপুট টোকেনের জন্য প্রযোজ্য। পড়ার সময় ক্যাশ করা প্রম্পট আবার ব্যবহার হয়; লেখার সময় সেগুলি সংরক্ষিত হয় এবং বাড়তি খরচ হতে পারে। আউটপুট টোকেনের জন্য আউটপুট মূল্য প্রযোজ্য।
অস্থির টেস্ট
1
অস্থির টেস্টে রানভেদে মিশ্র ফল হয়েছে (কমপক্ষে একটি পাস এবং একটি ফেল)।
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
রান ইতিহাস
| পরীক্ষিত হয়েছে | স্কোর | নির্ভরযোগ্যতা | সঠিক টেস্ট | মোট খরচ | তুলনা করুন |
|---|---|---|---|---|---|
| 2026-08-14 01:38 পুনরায় পরীক্ষা | 5.1 | 10.0 | $0.026 ↑ | তুলনা করুন | |
| 2026-07-16 21:14 নতুন টেস্ট যোগ হয়েছে | 5.1 | 10.0 | $0.025 ↓ | তুলনা করুন | |
| 2026-06-04 13:09 নতুন টেস্ট যোগ হয়েছে | 4.9 | 10.0 | $0.009 ↓ | বর্তমান রান | |
| 2026-05-21 23:44 স্যুইট পরিবর্তিত হয়েছে | 5.1 | 10.0 | $0.008 | তুলনা করুন | |
| 2026-04-14 00:56 প্রথম নথিভুক্ত রান | 5.1 | প্রযোজ্য নয় | $0.008 | তুলনা করুন |
এই রানটি ভিন্ন একটি বেঞ্চমার্ক স্যুইট ব্যবহার করেছে। ঐতিহাসিক পরিবর্তন পড়ার সময় স্যুইট পরিবর্তনও মাথায় রাখুন।
রান তুলনা
| রান | বেঞ্চমার্ক কভারেজ | স্কোর | ধারাবাহিকতা | নির্ভরযোগ্যতা | সঠিক টেস্ট | অস্থির টেস্ট | মোট আউটপুট টোকেন | মোট ইনপুট টোকেন | মোট খরচ | প্রতিক্রিয়া সময় (গড়) |
|---|---|---|---|---|---|---|---|---|---|---|
| 2026-06-04 13:09 · নতুন টেস্ট যোগ হয়েছে | 63/63 প্রচেষ্টা | 4.9 | 9.7 | 10.0 | 5/21 | 1 | 3,584 | 47,507 | $0.009 | 8.62s |
| 2026-04-14 00:56 · প্রথম নথিভুক্ত রান | 54/54 প্রচেষ্টা | 5.1 | 9.7 | প্রযোজ্য নয় | 4/18 | 1 | 3,617 | 0 | $0.008 | 10.18s |
| পার্থক্য | — | -0.2 | 0.0 | +1 | 0 | -33 | +47507 | +$0.001 | -1553ms |
বেঞ্চমার্ক কভারেজ আলাদা: 63/63 প্রচেষ্টা (লক্ষ্য: প্রতি টেস্টে 3টি পুনরাবৃত্তি) বনাম 54/54 প্রচেষ্টা (লক্ষ্য: প্রতি টেস্টে 3টি পুনরাবৃত্তি)। মোট মান ও পুনরাবৃত্তি-সংবেদনশীল মেট্রিক সরাসরি তুলনাযোগ্য নয়।
এই দুই রান ভিন্ন বেঞ্চমার্ক স্যুইট ব্যবহার করেছে, তাই পার্থক্যগুলোতে মডেল পরিবর্তন এবং স্যুইট পরিবর্তন দুটোই ধরা পড়ে।
মূল্যের ইতিহাস
OpenRouter থেকে এই মডেলের ঐতিহাসিক মূল্য তথ্য।
| তারিখ | ইনপুট মূল্য | আউটপুট মূল্য | ক্যাশ পড়ার মূল্য | ক্যাশ লেখার মূল্য |
|---|---|---|---|---|
| 2026-06-04 14:42 | $0.110 / 1M | $0.800 / 1M | প্রযোজ্য নয় | প্রযোজ্য নয় |
প্রথম মডেলটি নির্বাচন করুন, তারপর দ্বিতীয় মডেলে ক্লিক করে পাশাপাশি তুলনা পৃষ্ঠা খুলুন।
| বিভাগ | স্কোর | ধারাবাহিকতা | সঠিক টেস্ট |
|---|---|---|---|
| অ্যান্টি-এআই কৌশল | 3.6 | 10.0 | |
| কোডিং | 4.6 | 7.9 | |
| সমন্বিত | 3.0 | 10.0 | |
| ডেটা পার্সিং ও নিষ্কাশন | 6.5 | 10.0 | |
| ডোমেইন-নির্দিষ্ট | 5.3 | 10.0 | |
| Sadharon Buddhimotta | 10.0 | 10.0 | |
| নির্দেশনা অনুসরণ | 6.3 | 10.0 | |
| ধাঁধা সমাধান | 3.0 | 10.0 | |
| টুল কলিং | 10.0 | 10.0 | |
| সাধারণ জ্ঞান | 3.0 | 10.0 |