Advertise here
#204

Qwen3.6 Flash

Qwen প্রকাশ: 2026-04-20 পরীক্ষিত হয়েছে: 2026-08-14 01:42 qwen/qwen3.6-flash::none
~35B মোট (~3B সক্রিয়)MoEবন্ধ উৎসআনুমানিক
(medium) (none)

সারাংশ

Qwen3.6 Flash AI BENCHY-তে 6.1 স্কোর করে এবং #204 স্থানে আছে। এর reliability 10.0, pass rate 34.9%, মোট খরচ $0.062, এবং গড় response time 3.73s.

মডেলের তথ্য

গবেষণার তারিখ: 2026-08-12

আনুমানিক
প্যারামিটার
~35B মোট (~3B সক্রিয়)
আর্কিটেকচার
MoE
উপলভ্যতা
বন্ধ উৎস
লাইসেন্স
-

সর্বজনীন তথ্যপ্রমাণের ভিত্তিতে সেরা অনুমান; প্রদানকারী সব মান প্রকাশ করেনি।

ধারাবাহিকতা

9.6

মোট খরচ (বর্তমান মূল্য)

$0.062 ↓ -6.7%

পরীক্ষার সময়: $0.066

মোট আউটপুট টোকেন

30,947

মোট ইনপুট টোকেন

139,797

ইনপুট মূল্য

$0.188 / 1M

আউটপুট মূল্য

$1.125 / 1M

সঠিক টেস্ট

ভুল টেস্ট: 15

প্রতি চেষ্টায় পাস রেট: 34.9%

অস্থির টেস্ট

1

অস্থির টেস্টে রানভেদে মিশ্র ফল হয়েছে (কমপক্ষে একটি পাস এবং একটি ফেল)।

প্রতিক্রিয়া সময় (গড়)

3.73s

প্রতিক্রিয়া সময় (সর্বোচ্চ): 48.79s

প্রতিক্রিয়া সময় (মোট): 81.95s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#204 Qwen3.6 Flash

none
খরচ
$0.005
সময়
20.1s
টোকেন
4,211 tok

রান ইতিহাস

পরীক্ষিত হয়েছে স্কোর নির্ভরযোগ্যতা সঠিক টেস্ট মোট খরচ তুলনা করুন
2026-08-14 01:42 পুনরায় পরীক্ষা 6.1 10.0 $0.062 বর্তমান রান
2026-07-16 21:25 নতুন টেস্ট যোগ হয়েছে 6.1 10.0 $0.062 তুলনা করুন
2026-06-04 13:17 নতুন টেস্ট যোগ হয়েছে 5.4 10.0 $0.015 তুলনা করুন
2026-05-21 23:50 স্যুইট পরিবর্তিত হয়েছে 5.5 9.7 $0.019 তুলনা করুন
2026-04-27 23:05 প্রথম রান 5.8 10.0 $0.018 তুলনা করুন

এই রানটি ভিন্ন একটি বেঞ্চমার্ক স্যুইট ব্যবহার করেছে। ঐতিহাসিক পরিবর্তন পড়ার সময় স্যুইট পরিবর্তনও মাথায় রাখুন।

রান তুলনা

রানবেঞ্চমার্ক কভারেজস্কোরধারাবাহিকতানির্ভরযোগ্যতাসঠিক টেস্টঅস্থির টেস্টমোট আউটপুট টোকেনমোট ইনপুট টোকেনমোট খরচপ্রতিক্রিয়া সময় (গড়)
2026-08-14 01:42 · বর্তমান রান66/66 প্রচেষ্টা6.19.610.07/22130,947139,797$0.0623.73s
2026-06-04 13:17 · নতুন টেস্ট যোগ হয়েছে63/63 প্রচেষ্টা5.410.010.07/2104,16450,810$0.0151.60s
পার্থক্য+0.7-0.40.00+1+26783+88987+$0.047+2125ms

বেঞ্চমার্ক কভারেজ আলাদা: 66/66 প্রচেষ্টা (লক্ষ্য: প্রতি টেস্টে 3টি পুনরাবৃত্তি) বনাম 63/63 প্রচেষ্টা (লক্ষ্য: প্রতি টেস্টে 3টি পুনরাবৃত্তি)। মোট মান ও পুনরাবৃত্তি-সংবেদনশীল মেট্রিক সরাসরি তুলনাযোগ্য নয়।

এই দুই রান ভিন্ন বেঞ্চমার্ক স্যুইট ব্যবহার করেছে, তাই পার্থক্যগুলোতে মডেল পরিবর্তন এবং স্যুইট পরিবর্তন দুটোই ধরা পড়ে।

মূল্যের ইতিহাস

OpenRouter থেকে এই মডেলের ঐতিহাসিক মূল্য তথ্য।

তারিখ ইনপুট মূল্য আউটপুট মূল্য
2026-08-14 12:51 $0.188 / 1M $1.125 / 1M

চার্ট

প্রথম মডেলটি নির্বাচন করুন, তারপর দ্বিতীয় মডেলে ক্লিক করে পাশাপাশি তুলনা পৃষ্ঠা খুলুন।

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

দ্রুত তুলনা

বিভাগভিত্তিক বিশ্লেষণ

বিভাগ স্কোর ধারাবাহিকতা সঠিক টেস্ট
অ্যান্টি-এআই কৌশল 3.1 10.0
কোডিং 5.4 10.0
সমন্বিত 3.8 5.8
ডেটা পার্সিং ও নিষ্কাশন 10.0 10.0
ডোমেইন-নির্দিষ্ট 5.3 10.0
Sadharon Buddhimotta 10.0 10.0
নির্দেশনা অনুসরণ 6.3 10.0
ধাঁধা সমাধান 3.5 10.0
টুল কলিং 10.0 10.0
সাধারণ জ্ঞান 3.0 10.0

তুলনা করা মডেল